Nvidia
Последние новости
-
26.07.2026
Microsoft запустила собственные ИИ-модели вместо решений OpenAI и снизила затраты на 89% -
17.07.2026Локальный запуск LLM для SOC: сколько GPU действительно нужно?
-
04.07.2026Как я обучил русский RAG-сплиттер, который режет документы по индексам, а не по тексту
-
19.06.2026
L’Oréal ускоряет развитие генеративной AI-системы для контента благодаря новой сделке с OpenAI -
12.06.2026Сколько железа нужно ИИ-агенту: как считали ресурсы для on-premise LLM и почему калькуляторы ошиблись в 5 раз
-
30.05.2026Как я собрал LLM-печку на четырёх GPU и что она умеет
-
25.05.2026Обзор серверного ускорителя NVIDIA Tesla V100 16 ГБ в корпусе от RTX 4090: часть 3 — запуск локальных моделей ИИ
-
18.05.2026Qwen3.6 27B MTP добавляет около 0,3 ГБ веса и ускоряет генерацию примерно в 2 раза: с 60 до 130 t/s без потерь
-
28.04.2026Железо и игры: собираем игровой ПК в условиях дефицита памяти
-
26.04.2026
Расход токенов — не AI-стратегия -
18.04.2026Opus 4.7, Codex управляет ПК, TTS от Google, а бренд кроссовок переходит в ИИ
-
18.04.2026Как я локально тестировал новый Qwen 3.6 и Gemma 4
-
14.04.2026Бесплатный API для нейросетей от NVIDIA: более 100 моделей, OpenAI-совместимый эндпоинт и 40 запросов в минуту
-
19.02.2026Запуск gpt-oss на 20B и 120B параметров на Core i9: сравнение инференса на CPU и GPU (RTX 4090)
-
10.02.2026
Сможет ли OpenAI свести экономику? Это вопрос на триллион долларов. -
07.02.2026Новый релиз Ollama 0.15.5
-
30.01.2026
Акции Microsoft упали почти на 10% — компания потеряла $357 млрд рыночной капитализации -
25.01.2026Локальное клонирование голоса по 3-секундному образцу: обзор Qwen3-TTS, примеры на русском и портативная версия
-
20.01.2026
CEO Akamai просит помощи в борьбе с пиратством и считает, что с edge AI справится сам -
18.01.2026Ретроспектива 2025: год LLM — практика, иллюзия и реальные сдвиги
-
04.01.2026Ваш ноутбук пока не готов к LLM, но скоро это изменится
-
29.12.2025Meeting-LLM: Транскрипция + ИИ-анализ совещаний в одном окне своими руками (T-One + GPT-OSS-20B)
-
23.12.2025Выбор LLM и фреймворка для ИИ-агентов
-
16.12.2025Ускоряем LLM по максимуму: кроссплатформенный FlashAttention 2 на Triton с поддержкой архитектур Turing+ и не только
-
13.12.2025Сборка высокопроизводительного AI-десктопа