DRAйверы для GPU: как Kubernetes научился выделять устройства через стандартный API
Обзор
Новости ИИ
676 материалов — отфильтровано, классифицировано, без дублей
Покопались в .cursorrules на GitHub и нашли там волка-фурри, Star Trek и 28.7% копипасты
Spec-driven development в микросервисах, часть 2: как archspec делает контекст сервисов я…
Свой AI-агент из почты, systemd и LLM
Обзор серверного ускорителя NVIDIA Tesla V100 16 Gb в корпусе от RTX 4090: Часть 3 — Запу…
Как использовать подписку ChatGPT и Claude в Cursor без оплаты за API токены
Пет-проект, который не умер: система бронирования устройств как полигон для AI-разработки
[Перевод] Масштабирование LLM: от одного чипа до ЦОДа. Глава 2. Шардинг
AGENTS.md создавали, чтобы помогать агентам. Я использую его, чтобы их вычислять
MCP-агрегатор: объединяем инструменты для LLM в один сервер
CodeGraph: граф кода для Claude Code вместо grep по файлам. Разбираю архитектуру и провер…
LLM-инференс на фотонах? Препарируем передовые технологии, представленные в апреле
[Перевод] Нехватка CUDA-памяти при обучении с GRPO: как перестать гадать и начать считать
RAG для тех, кто разочаровался: почему retrieval ломается и как это починить
Как развернуть Mistral 7B на GPU-сервере через vLLM
LLM без поиска — генератор галлюцинаций. Как мы с этим справились при создании поиска по …