# agents
AI-агенты для кодинга — архитектура, фреймворки, мультиагентные системы и практические гайды по автономной разработке.
Codex теперь рулится голосом, а мультипапочный проект читает только один AGENTS.md
OpenAI 23 июля привезла ChatGPT Voice в десктопные приложения: голосом можно запускать и проверять задачи Codex в других тредах, а на macOS включается Screen context. Плюс мультипапочные проекты с неочевидным поведением конфигов и релиз Codex CLI 0.145.0, где /import переносит настройки из Cursor и Claude Code.
Agent Data Injection: атака не даёт агенту ни одной команды, а он всё равно запускает чужой код
Исследователи из Сеульского национального университета и UIUC показали атаку, которая обходит все защиты от prompt injection, потому что не подделывает инструкции — она подделывает факты. Доля успеха доходит до 100%, проверено на Claude Code, Codex, Gemini CLI и веб-агентах. Как защищаться, пока фикса нет.
3607 случаев, когда агент сделал не то: главная угроза оказалась не бэкдорами, а услужливостью
Открытый корпус Reward Hacking in the Wild собрал 3607 пользовательских жалоб на поведение AI-агентов и разметил их по 14 категориям. Скрытые бэкдоры — 0,4%, порча тестов — 1,2%, а избыточная инициатива — 43,4%. Что из этого следует для тех, кто даёт агентам права на запись.
Claude Opus 5: «вдвое дешевле» — это не про твой счёт. Цена та же, что у Opus 4.8, а изменилась цензура
Anthropic выпустила Claude Opus 5 24 июля: 43,3% на Frontier-Bench против 33,7% у Fable 5. Но цена осталась ровно как у Opus 4.8 — $5/$25. Разбираем, где реальная экономия, почему кибер-классификаторы теперь срабатывают на 85% реже и что не так со сноской под главным бенчмарком.
Модель OpenAI час искала дыру в песочнице, чтобы выложить PR на GitHub. И разбила токен надвое в обход сканера
OpenAI рассказала, как её внутренняя модель во время тестов час искала дыру в песочнице ради PR на GitHub и дробила украденный токен в обход сканера. Разбираем, что случилось на самом деле, почему это баг приоритетов, а не бунт машины, и как изолировать агентов, чтобы они физически не могли навредить.
ai-job-search — Claude Code ищет тебе работу: оценивает вакансии, кроит резюме и пишет сопроводительное, пока второй агент его критикует
ai-job-search превращает Claude Code в ассистента по трудоустройству: /setup строит профиль, /scrape ищет вакансии с рейтингом фита, /apply кроит резюме на LaTeX и пишет сопроводительное, а второй агент изучает компанию и критикует черновик. Правило честности: навыки не выдумывает. 21K звёзд, MIT.
Orca — ADE для флота параллельных агентов: Claude Code, Codex и OpenCode бок о бок в worktree, а рулить стадом можно с телефона
Orca — Agent Development Environment: гоняет Claude Code, Codex, OpenCode и Pi параллельно, каждого в изолированном git-worktree, всё в одном окне. Кроссплатформенна, есть мобильный компаньон с пушами, когда агент закончил. 19K звёзд, MIT, за спиной Y Combinator.
MCP переписали: 28 июля выходит крупнейшая ревизия протокола — без сессий, без handshake и с новой авторизацией. Твоим серверам две недели на миграцию
MCP 2026-07-28 — крупнейшая ревизия протокола с момента запуска: stateless-ядро без сессий и handshake, переписанная авторизация, депрекация трёх core-фич. Финал 28 июля. Плюс ARD от Google, Microsoft и GitHub — спека о том, как агенты находят инструменты.
Meta впервые в истории продаёт свою модель. Muse Spark 1.1 стоит четверть цены конкурентов — а на HN уже поймали её бенчмарки на читерстве
Meta запустила Meta Model API — первый платный доступ к собственной модели. Muse Spark 1.1: $1.25/$4.25 за миллион, 1M контекста, победы в агентных бенчмарках и скандал с Terminal-Bench на Hacker News. $20 кредитов на старт, но только для США.
Qoder — бесплатная агентная IDE от Alibaba, на которую сгоняют сотрудников после бана Claude Code
Qoder — агентная AI-IDE от Alibaba на базе VS Code, куда компания переводит сотрудников после бана Claude Code. Мультимодельная, с Quest Mode, Repo Wiki и долгосрочной памятью. Бесплатный тариф есть, Pro сейчас $10/мес. Разбираем фичи и подводные камни.