Препарация трансформера
Обзор
Новости ИИ
432 материалов — отфильтровано, классифицировано, без дублей
ИИ-детекторы: патенты в мире и в России
QuantCode-Bench: умеют ли LLM генерировать исполняемые алгоритмические торговые стратегии
Mamba: архитектура, которая шла убивать трансформеры
Походка за двадцать минут и миллион рублей: что RL сделал с двуногими роботами и во что у…
[Перевод] Как оценить библиотеку для ИИ-агентов без слепой проверки финального ответа
J-пространство Anthropic: рабочее пространство, сделанное из слов. Почему Выготский объяс…
FINESSE-Bench: как мы обновили финансовый бенчмарк для LLM
Побеждаем нестабильность данных
habrGPT. Обучим LLM 0.5B с нуля на статьях Хабра с помощью nanochat от Карпатого. Обучени…
Квантование ломает вызов инструментов не так, как показывает BFCL: проверил на MCP-сервер…
От текста к смыслу: Embeddings, GPT и многомерные векторы в конкурентном анализе мобильны…
Детектор был прав, разметка врала: как мы искали слепую зону LLM-судей и нашли ошибки в э…
Под капотом у MOLOT’а: обзор ML-модели для обнаружения вредоносного кода
Как устроены voice-2-voice модели
НейроАрхиватор через инференс
Маленькая модель на 0.6B держит квантование лучше, чем «крупная» на 1B: измерил деградаци…
[Перевод] Когда ИИ-агент ошибается молча: 6 отказов, которые не видно по ответу
Подводные камни Learned Motion Matching: опыт реализации
[Перевод] Как на самом деле работают LLM
Что общего у ИИ-агентов, телефонных мошенников и старины Зигмунда
Помочь пользователю открыть новое: как мы боролись с замкнутым кругом рекомендаций в Янде…
[Перевод] Внутри Claude нашли сознание у моделей. J-пространство в LLM
Можно ли лучше? Activation Steering, pt 2: repeng, pyreft и другие способы найти вектор п…
Как мы строили свою базу данных о киберугрозах для LLM-агентов и SOC
Библиография тоже умеет галлюцинировать: что изменилось после защиты диплома
Как мы за $2k собрали управляемую мировую модель на базе Wan 2.1
Contextual Retrieval: техника, которая чинит главную проблему RAG за 50 центов на тысячу …
Два в одном: шумоподавление и дереверберация в реальном времени
[Перевод] Диалоговые потоки в агентном ИИ: чему нас научила эксплуатация таких систем в п…