Восемь способов улучшить работу с AI-агентами, документацией и проверками.
21–28 сентября 2026приёмов: 8на заметку: 3постов в корпусе: 2050
О чём говорят на этой неделе
Авторы всё чаще описывают проверку работы агента как часть обычной разработки. Линтер читает документацию после правки, ревью кода начинается с точного выбора файлов, а ошибки AI-функции попадают в обновляемый набор проверок. Ещё одна заметная тема — история сессий: её сохраняют, чтобы понять, какие команды привели к результату.
Набор тестов агента рос без проверки того, какие ошибки он действительно ловит.
→
Стало
Навык eval-audit проходит по существующей схеме проверок и расставляет найденные проблемы по важности.
Почему: Так появляется список конкретных дыр в проверках. Автор не приводит измеренного выигрыша, поэтому результат стоит проверить на собственных ошибках.
Из источника↗
Скриншот исходного материала показывает команду установки и пример запроса к eval-скиллу.
Попробовать за вечер
Установи навыки из ai-evals-course/evals-skills.
Запусти /eval-audit для одной AI-функции и проверь каждое замечание по её реальным сбоям.
Измерь число подтверждённых замечаний и время на исправление первого.
Агент сам решал, какие файлы читать в большом изменении, и мог пропустить нужный diff.
→
Стало
OpenCodeReview сначала детерминированно выбирает изменённые файлы, затем поручает отдельные части агентам.
Почему: Правило выбора файлов можно проверить независимо от текста ревью. Сам проект предупреждает о компромиссе: точность выше, но полнота замечаний ниже.
Из источника↗
Инфографика автора раскладывает проверку кода по выбору файлов, правилам и месту замечания.
Попробовать за вечер
Установи @alibaba-group/open-code-review и запусти ocr review --from main --to feature-branch на тестовой ветке.
Сравни список выбранных файлов и замечания с ручным ревью того же diff.
История Claude Code, Codex и Cursor лежала в разных форматах, и путь к ошибке приходилось восстанавливать вручную.
→
Стало
Agent Beacon собирает события сессий; команды beacon traces и локальная панель позволяют открыть ход работы.
Почему: Можно увидеть команды, правки и вызовы инструментов одной сессии. При настройке endpoint выбери Local явно: мастер предлагает управляемый сервис.
Попробовать за вечер
Установи Agent Beacon по README и при настройке выбери Local.
Открой beacon traces для одной завершённой сессии и проверь путь от запроса до правок.
Измерь, сколько времени ушло на поиск причины одной ошибки.
Источник публичная лента Nitter через Firecrawl; метрики реакций проверены для короткого списка. Общего ранжирования по реакциям нет.
Пробелы сбора "token cost" OR "cost per token" min_faves:20; "rag pipeline" OR "retrieval" llm min_faves:30; vllm OR sglang min_faves:20; "subagent" OR "sub-agent" min_faves:20. По этим четырём темам собрано меньше пяти дней; другие цели покрыли неделю.
Медиа 3 карточки с просмотренной исходной графикой.