Google представила DiffusionGemma-26B-A4B-it — диффузионная модель для генерации текста с 4-кратным приростом скорости
Видеокарта NVIDIA Tesla V100 32GB: обзор характеристик и тестирование на LLM моделях
Alibaba представила Qwen-Image-Layered: ИИ-генератор с редактированием слоев
NVIDIA DGX Spark: мощный старт, но противоречивые тесты
Гид по выбору GPU Nvidia — как не потеряться в каталоге в 2026
Обзор видеокарты NVIDIA A100 40GB – топ вчерашнего дня
Тестируем восемь NVIDIA Tesla P100 в ComfyUI: генерируем изображения и видео
Тест восьми NVIDIA Tesla P100 в 2026 году на базе GPU сервера
Z.ai представила GLM-5.2 — открытая 753b-модель с контекстом в 1 миллион токенов обходит Fable 5 на Design Arena
AMD начинает продажи Ryzen AI Halo: компактный ИИ-ПК за $3999
Moonshot AI представила Kimi K2.7 Code — новая флагманская модель для агентной разработки
Сервер виртуализации: как работает, зачем нужен и в чем его польза
Anthropic представила Claude Fable 5: безопасная версия ИИ-модели уровня Mythos с рекордной производительностью
Nvidia представила Nemotron 3 Ultra 550b — новая флагманская модель на архитектуре MoE для управления ИИ-агентами
Nvidia выпустила Cosmos 3 Super и Nano — две новые открытые модели мира на архитектуре MoE
Nvidia анонсирует DGX Station под управлением Windows on ARM
Nvidia представила дорожную карту RTX Spark — будущие ИИ-ПК на базе Vera Rubin с LPDDR6 и Rosa Feynman
Nvidia представила RTX Spark — 20-ядерные Grace-чипы с графикой уровня RTX 5070 для ПК и ноутбуков с Windows on ARM
Вышла PaddleOCR-VL-1.6 — новая лучшая OCR-модель с точностью 96.33%
Anthropic представила Claude Opus 4.8 — новый флагман с честными ответами и настраиваемым размышлением
Первые тесты Nvidia Vera CPU — так ли все хорошо?
GPUDirect от NVIDIA: Ускорение обмена данными для AI и HPC‑инфраструктур
vLLM вводит поддержку Intel Arc Pro B60
Подробно о ROCm 7.0 для AMD GPU: что нового и стоит ли обновляться
Что такое Triton Inference Server и зачем он нужен в продакшене LLM
TensorRT: ускорение инференса на GPU NVIDIA Blackwell, Hopper и Ampere
Что такое структурная разреженность и зачем она нужна NVIDIA
Что такое NVIDIA AI Enterprise и зачем это бизнесу.
Nvidia HGX, DGX и MGX: что это такое и в чем их отличия?
Nvidia DGX Station и DGX Spark — ваши личные LLM-суперкомпьютеры
Что такое DGX-OS: как устроена серверная ОС NVIDIA для ИИ и HPC-нагрузок
Полное руководство по лицензированию технологии NVIDIA vGPU
Аналог GPUDirect от AMD: как работает ROCm RDMA и Peer-to-Peer
AllenAI выпустила olmOCR 2: новый конкурент топовых OCR-нейросетей
Дебют AMD в MLPerf Training 5.0 — MI325 теперь эффективнее H200
Curiosity-driven Exploration: новый подход к обучению с подкреплением для “любопытных” LLM
MoE-модель (Mixture of Experts): что это и как работает архитектура AI
Что такое параметры модели: почему DeepSeek бывает на 7B, 70B и 405B
AMD готовит Radeon AI Pro R9700S и R9600D для ЦОД и рабочих станций
DeepSeekMath-V2: новый прорыв DeepSeek в математических задачах
Tencent представила HunyuanOCR: новая веха в мультимодальном распознавании текста