Nvidia
Последние новости
-
26.07.2026
Microsoft запустила собственные ИИ-модели вместо решений OpenAI и снизила затраты на 89% -
17.07.2026
Локальный запуск LLM для SOC: сколько GPU действительно нужно? -
04.07.2026
Как я обучил русский RAG-сплиттер, который режет документы по индексам, а не по тексту -
19.06.2026
L’Oréal ускоряет развитие генеративной AI-системы для контента благодаря новой сделке с OpenAI -
12.06.2026
Сколько железа нужно ИИ-агенту: как считали ресурсы для on-premise LLM и почему калькуляторы ошиблись в 5 раз -
30.05.2026
Как я собрал LLM-печку на четырёх GPU и что она умеет -
25.05.2026
Обзор серверного ускорителя NVIDIA Tesla V100 16 ГБ в корпусе от RTX 4090: часть 3 — запуск локальных моделей ИИ -
18.05.2026
Qwen3.6 27B MTP добавляет около 0,3 ГБ веса и ускоряет генерацию примерно в 2 раза: с 60 до 130 t/s без потерь -
28.04.2026
Железо и игры: собираем игровой ПК в условиях дефицита памяти -
26.04.2026
Расход токенов — не AI-стратегия -
18.04.2026
Opus 4.7, Codex управляет ПК, TTS от Google, а бренд кроссовок переходит в ИИ -
18.04.2026
Как я локально тестировал новый Qwen 3.6 и Gemma 4 -
14.04.2026
Бесплатный API для нейросетей от NVIDIA: более 100 моделей, OpenAI-совместимый эндпоинт и 40 запросов в минуту -
19.02.2026
Запуск gpt-oss на 20B и 120B параметров на Core i9: сравнение инференса на CPU и GPU (RTX 4090) -
10.02.2026
Сможет ли OpenAI свести экономику? Это вопрос на триллион долларов. -
07.02.2026
Новый релиз Ollama 0.15.5 -
30.01.2026
Акции Microsoft упали почти на 10% — компания потеряла $357 млрд рыночной капитализации -
25.01.2026
Локальное клонирование голоса по 3-секундному образцу: обзор Qwen3-TTS, примеры на русском и портативная версия -
20.01.2026
CEO Akamai просит помощи в борьбе с пиратством и считает, что с edge AI справится сам -
18.01.2026
Ретроспектива 2025: год LLM — практика, иллюзия и реальные сдвиги -
04.01.2026
Ваш ноутбук пока не готов к LLM, но скоро это изменится -
29.12.2025
Meeting-LLM: Транскрипция + ИИ-анализ совещаний в одном окне своими руками (T-One + GPT-OSS-20B) -
23.12.2025
Выбор LLM и фреймворка для ИИ-агентов -
16.12.2025
Ускоряем LLM по максимуму: кроссплатформенный FlashAttention 2 на Triton с поддержкой архитектур Turing+ и не только -
13.12.2025
Сборка высокопроизводительного AI-десктопа