AMD начинает продажи Ryzen AI Halo: компактный ИИ-ПК за $3999
Первые тесты Nvidia Vera CPU — так ли все хорошо?
Anthropic представила Claude Opus 4.8 — новый флагман с честными ответами и настраиваемым размышлением
Вышла PaddleOCR-VL-1.6 — новая лучшая OCR-модель с точностью 96.33%
Nvidia представила RTX Spark — 20-ядерные Grace-чипы с графикой уровня RTX 5070 для ПК и ноутбуков с Windows on ARM
Nvidia представила дорожную карту RTX Spark — будущие ИИ-ПК на базе Vera Rubin с LPDDR6 и Rosa Feynman
Nvidia анонсирует DGX Station под управлением Windows on ARM
Nvidia выпустила Cosmos 3 Super и Nano — две новые открытые модели мира на архитектуре MoE
Nvidia представила Nemotron 3 Ultra 550b — новая флагманская модель на архитектуре MoE для управления ИИ-агентами
Anthropic представила Claude Fable 5: безопасная версия ИИ-модели уровня Mythos с рекордной производительностью
Google представила DiffusionGemma-26B-A4B-it — диффузионная модель для генерации текста с 4-кратным приростом скорости
Moonshot AI представила Kimi K2.7 Code — новая флагманская модель для агентной разработки
Что такое EmbeddingGemma и как она улучшает локальный RAG
Z.ai представила GLM-5.2 — открытая 753b-модель с контекстом в 1 миллион токенов обходит Fable 5 на Design Arena
Тест восьми NVIDIA Tesla P100 в 2026 году на базе GPU сервера
Тестируем восемь NVIDIA Tesla P100 в ComfyUI: генерируем изображения и видео
RAG (Retrieval-Augmented Generation): что это и как работает в 2026 году
LangChain и RAG: как связать генеративный ИИ с базами знаний в 2026 году
RAG vs Fine-Tuning: что выбрать для бизнеса и разработчиков в 2026 году
LlamaIndex: что это и как использовать для RAG
Graph-RAG и Agentic RAG: следующий шаг в развитии Retrieval-Augmented Generation
IBM представила Granite 4.0: лучшие LLM для RAG-интеграции
RAGFlow — открытый движок RAG с графическим интерфейсом