[Перевод] Как оценить библиотеку для ИИ-агентов без слепой проверки финального ответа
Обзор
Новости ИИ
1888 материалов — отфильтровано, классифицировано, без дублей
Нейроаналитик в Yandex DataLens: обзор AI-агента для анализа данных
Пять действительно полезных AI-плагинов для Obsidian
From Wizard to Warlock: магия в D&D как метафора эпохи LLM
Чек-лист тестирования поисковой системы: от engine sanity до RAG и графов знаний
J-пространство Anthropic: рабочее пространство, сделанное из слов. Почему Выготский объяс…
FINESSE-Bench: как мы обновили финансовый бенчмарк для LLM
Как мы внедряли ИИ на 500 инженеров, а скорость не росла. Часть 2. Почему AI-first команд…
Жизнь после RAG: MCP, логи и автоматический анализ тикетов Jira
Разработка автоматизаций в Home Assistant с помощью Claude
Saint TeamLead-2026: ИИ-агенты меняют индустрию разработки
Создание харнесса для код-агентов под enterprise-фреймворк на Java
Своя GPT-like LLM по WH40K с нуля. Часть 1: токенизируем Империум
Побеждаем нестабильность данных
Вайб-кодинг без розовых очков: как я писала свой продукт с Claude
habrGPT. Обучим LLM 0.5B с нуля на статьях Хабра с помощью nanochat от Карпатого. Обучени…
OpenAI Realtime против Яндекс Realtime: сравнил два голосовых движка для России и за вече…
Квантование ломает вызов инструментов не так, как показывает BFCL: проверил на MCP-сервер…
Сотрудники сливают данные в чужой ИИ. Разбираемся чем это грозит
Голосовой ИИ-репетитор изнутри: архитектура разговора в реальном времени
От текста к смыслу: Embeddings, GPT и многомерные векторы в конкурентном анализе мобильны…
Автоматизация — это на 90% подготовка. Четыре решения, которые принимаются до первой стро…
Дискуссия «Дивный новый SDLC: с какой реальностью мы столкнулись, «ускорив» разработку»
Цитата — это ещё не рекомендация: разбираю, что на самом деле двигает бренд в ответах ИИ
Детектор был прав, разметка врала: как мы искали слепую зону LLM-судей и нашли ошибки в э…
AI-дайджест #2
ИИ снова закрывается: почему нейросети оказались на грани блокировок
Топ вопросов с NLP собеседований: обучение LLM, prompt-engineering и alignment
Kodacode релиз v1.0. Новая модель Koda pro основанная на GLM 5.2
Нейросеть — плохой калькулятор, и это не баг