Как оптимизировать инференс LLM: кеширование, время ответа и GPU-ресурсы
Обзор
Новости ИИ
543 материалов — отфильтровано, классифицировано, без дублей
Токенная диета для ИИ-агентов: Caveman, Ponytail и Headroom
Нейросеть-автопилот вместо 400 Playwright-тестов
Куда делись мои токены?
Как заставить ИИ соблюдать закон, не трогая веса. Выкладываем в открытый доступ внешний ф…
Как заставить ИИ соблюдать закон, не трогая веса. Выкладываем в открытый доступ внешний ф…
Как развернуть ТГ-бота на хостинге не выходя из чата с нейронкой
[Перевод] Аутентификация в MCP в 2026: как было, как есть и как будет
Как мы научили AI разбирать упавшие автотесты и заводить баги в Трекере
От Triton Inference Server к NVIDIA Dynamo: как изменился inference для агентов в 2026
От Triton Inference Server к NVIDIA Dynamo: как изменился inference для агентов в 2026
От REST к MCP: как LLM меняют принципы проектирования API и архитектуры систем. Часть пер…
Мы меняли LLM и промпты, а ошибка оказалась совсем в другом месте
RAG для закупок: Qdrant и LlamaIndex в локальном контуре
Как мы создавали «умный» поиск по регламенту вуза
Как компании строят MLOps без собственной ML-платформы: workflow-фреймворки
[Перевод] Как я собрал инфопанель на ESP32, поручив написание кода нейросетям
AI‑агенты в проде: как оценивать качество, стоимость и стабильность
Gramps + Claude: self‑hosted генеалогия с ИИ‑помощником
Дашборд красиво врал. Как я с ИИ разобрала данные и пересобрала отчет без очереди к анали…
Как быстро собрать полезный инструмент: транскрибатор видео с помощью вайб‑кодинга
От REST к MCP: как LLM меняют принципы проектирования API и архитектуры систем. Часть 2
Продакшн на Laravel руками ИИ‑агента: честный отчёт о том, что работает, а что чуть не ур…
Харнесс, который мы заслужили: как я собираю AI-систему для разработки SaaS (orca + pi ag…
Claude Desktop на Linux, через прокси
Библиография тоже умеет галлюцинировать: что изменилось после защиты диплома
Mix Hub в свой VST3-плагин: анализ конфликтов между дорожками
Как я обучил русский RAG‑сплиттер, который режет документы по индексам, а не по тексту
Оптимизация потребления памяти в ML-библиотеке LANCETNIC
Как я хакнул рынок труда: пишем свой ИИ-комбайн для автооткиков на HH.ru