agents

Codex — не чат-бот, а агент: как формулировать задачи, чтобы он делал их правильно

Метод работы с Codex: формула задачи Goal-Context-Constraints-Done, Plan mode, режимы одобрения, CLI или облако и проверка результата — по шагам, без воды.

20 мин. чтения

Meta Muse Code в бете: токены в 21 раз дешевле в обмен на ваш код

Meta открыла бету Muse Code — терминального агента на модели Muse Spark 1.2. Дешёвый тариф стоит $0,20 за млн токенов, но Meta учится на вашем коде.

3 мин. чтения

Visa натравила Claude Mythos на собственную платёжную сеть — и выложила обвязку, которая это сделала

Visa открыла код Visa Vulnerability Agentic Harness: 11 стадий, состязательная проверка находок и авто-починка. Лицензия Apache 2.0, работает с Claude.

4 мин. чтения

Мульти-агентное ревью кода: как генератор и критик ловят пропущенные баги

Адверсариальное мульти-агентное ревью: как N независимых ИИ-критиков с голосованием ловят баги, которые пропускает один проход, сколько это стоит и где ломается.

15 мин. чтения

Test-Driven Development с ИИ: «готово» — это зелёные тесты, а не мнение агента

Как понять, что ИИ-агент реально доделал задачу, а не сказал «готово»: verification loop, TDD, eval-driven разработка и чек-лист Definition of Done.

12 мин. чтения

Git worktree: как запускать несколько агентов Claude Code без конфликтов

git worktree даёт каждому агенту Claude Code свою копию репозитория — параллельные сессии не затирают файлы друг друга. Разбираем изоляцию, команды и риски.

21 мин. чтения

Claude Code без интерфейса: headless-режим, Agent SDK и подводные камни автоматизации

Как встроить Claude Code в скрипты и CI: headless-режим claude -p, Agent SDK на Python и TypeScript, лимиты, ретраи и спорный вопрос подписки против API-ключа.

15 мин. чтения

Дисциплина вайб-кодинга: 12 приёмов против «готово» вместо рабочего кода

12 копируемых приёмов дисциплины вайб-кодинга: guard-фраза, self-audit, impact-analysis, anti-rationalization — чтобы код не только выглядел готовым, но и работал.

12 мин. чтения