Селф-хост на RTX PRO 6000, продолжение: 2-битный DeepSeek V4 Flash x Ornith1.5-35B, как о…
Обзор
Новости ИИ
135 материалов — отфильтровано, классифицировано, без дублей
[Перевод] OpenAI Jalapeño: Персональный чип OpenAI, который обогнал NVIDIA Blackwell
Больше памяти — не значит быстрее: prefill, decode и релиз Apple M5 Ultra
Селф-хост Ornith-1.5 и Qwen3.8: тестирую 18 квантов на одной карте и похоже не покупаю RT…
Wan 3.0: Alibaba выводит AI-видео из режима «короткого клипа» в режим «законченной сцены»
Unlimited-OCR от Baidu: читает страницу как картинку
GigaChat 2 Max с памятью на связях обходит Claude Opus 5 без неё: замер семи моделей
753B на одной видеокарте: разбор FreeToken
Корпоративный мозг на одной видеокарте: что на самом деле умеет локальная модель
Gemini 3.7 Flash: это снова не та модель, которую все ждали
[Перевод] Qwen3.8-27B: лучший локальный LLM, который вы, вероятно, не сможете запустить
А все-таки Qwen3.8-27B — думает меньше и быстрее чем 3.6
ГигаАгент от Сбера. Первый блин слопом
Не в 12,1 раз, а 2,3–2,9: сколько стоит новый тариф DeepSeek V4 и почему все решают 3 час…
ИАД x Сайбокс
Возвращение короля: разбираемся, что такое Qwen3.8 27B
Сравниваем LLM, 12 тестов для китайских флагманов: Kimi K3, GLM-5.2, DeepSeek V4 Pro и Qw…
Qwen3.8-27B на своей карте против 304B по API
ИИ‑прогноз погоды на своём железе: запускаем AIFS 2.0 от ECMWF
Qwen 3.8 27B: лучше чем Opus 4.6
Почему Илону Маску не удается создать по-настоящему правдивую нейросеть?
GLM-5.3: Z.ai выпустил новую модель
Qwen3.5/3.6 на 16Гб VRAM: кванты, fine-tune, сравнение и немного про Gemma-4
Grok 4.6 вышел: разбираем тесты и цену долгих задач
[Перевод] Встречаем Grok 4.6
Вышел Grok 4.6 — разбираем, как модель взяла уровень GPT-5.6 по цене вдвое ниже
«Тосок бессмысл»: как я не смог заставить Gemma 4 писать хорошие стихи
Grok Imagine Image 2.0 — ставка на редактирование, а не на генерацию
Как генерировать реалистичных людей по десяткам признаков
Июльский дайджест — сервер за 30 секунд, новые модели и токены на агента