> · · 6 мин

Codex теперь рулится голосом, а мультипапочный проект читает только один AGENTS.md

Codex теперь рулится голосом, а мультипапочный проект читает только один AGENTS.md

Голосовое управление в редакторах обычно заканчивается диктовкой: наговорил комментарий, он вставился, всё. OpenAI 23 июля выкатила другое: режим, в котором ты голосом не диктуешь текст, а раздаёшь задачи и спрашиваешь о статусе работ, идущих в других тредах. Плюс к этому в десктопном приложении починили давнюю боль: проект наконец может состоять больше чем из одной папки.

TL;DR: Обновление 26.715 приносит ChatGPT Voice на macOS и Windows: голосом можно запускать, проверять и корректировать задачи в Chat, Work и Codex. На macOS включается Screen context — модель видит снимок активного окна. Локальные проекты теперь собираются из нескольких папок, но AGENTS.md, скиллы и config.toml читаются только из основной. Двумя днями раньше вышел Codex CLI 0.145.0, где /import перетаскивает настройки из Cursor и Claude Code, а мультиагентный режим V2 объявлен стабильным.

Что делает ChatGPT Voice в десктопном приложении

Голосовой режим работает поверх full-duplex модели GPT-Live и работает не диктофоном, а пультом. Начинаешь чат или задачу голосом, а дальше просишь запустить, проверить или подправить работу в других тредах — включая задачи Codex.

Практически это выглядит так: пока Codex молотит рефакторинг в одном треде, ты голосом спрашиваешь, на каком он шаге, и говоришь ему заодно прогнать тесты в другом проекте. Руки при этом заняты чем-то ещё. Разница с обычной диктовкой в том, что модель не превращает речь в текст промпта, а исполняет её как управляющие команды над уже запущенными работами.

На macOS отдельно включается Screen context — режим, где ассистент получает снимок активного окна. Это закрывает главную дыру голосового интерфейса: не нужно словами описывать, что у тебя на экране.

Голос доступен на планах Plus, Pro, Business, Edu и Enterprise — в десктопном приложении и через Remote на iOS. На бесплатном тарифе его нет.

Мы писали про GPT-Live в июле как про анонс с листом ожидания. Вот он и доехал до продукта — правда, пока как фича приложения, а не как открытый разработчикам API.

Как работают мультипапочные проекты и где ловушка

Локальный проект в десктопном приложении теперь может включать несколько связанных папок: меню проекта → Edit project → добавить папки и выбрать основную. Ловушка в слове «основную».

Новые чаты, операции с git и автоматический поиск AGENTS.md, скиллов и config.toml идут только от основной папки. Вторичные папки остаются доступными для поиска по файлам, чтения и редактирования — но своей конфигурацией они не управляют.

Для монорепы это неважно. А вот для типичного расклада «фронт в одном репозитории, бэк в другом» это значит, что AGENTS.md бэкенда агент проигнорирует, если основной назначен фронт. Правила, которые ты аккуратно писал под второй проект, просто не подхватятся, и понять это по поведению агента сложнее, чем хотелось бы. Совет простой: назначай основной ту папку, чьи конвенции важнее, а критичные правила из второй продублируй в основной AGENTS.md.

Что приехало в Codex CLI 0.145.0

Релиз от 21 июля — тот случай, когда в CLI интереснее, чем в GUI. Три вещи стоят внимания.

/import теперь переносит чужие конфиги. Команда мигрирует настройки, MCP-серверы, плагины, сессии, команды и проектные memories из Cursor и Claude Code. Это ровно тот барьер, который держал людей на текущем инструменте: не жалко подписки, жалко полдня на перенос обвязки. Теперь перенос — одна команда:

npm install -g @openai/codex@0.145.0
codex
# внутри сессии
/import

Мультиагентный режим V2 объявлен стабильным. С настраиваемыми моделями для субагентов, уровнями рассуждения, конкурентностью и восстановлением ролей. То есть можно раздать дешёвую модель субагентам, а дорогую оставить координатору — и это больше не эксперимент. Настройки объединены под ключом agents. Отдельно в релиз завезли предупреждение: если выбрать Ultra-уровень рассуждения при высокой конкурентности субагентов, интерфейс скажет, что расход полетит быстро. Полезная мелочь, которую обычно узнают по счёту.

Экспериментальная постраничная история тредов с быстрым возобновлением, поиском, сохранёнными именами, поддержкой субагентов и memories. Для тех, у кого сессии живут неделями, это заметнее любого прироста на бенчмарке.

Подводные камни

  • Screen context только на macOS. На Windows голос есть, «покажи, что у меня на экране» — нет. Для команды на смешанном парке машин это означает два разных воркфлоу.
  • Основная папка забирает себе всю конфигурацию. AGENTS.md, скиллы и config.toml вторичных папок игнорируются. Это не баг, это описанное поведение, но оно тихое: агент просто не будет знать про твои правила.
  • Голос — не для опенспейса и не для бесплатного тарифа. Full-duplex означает, что модель слушает непрерывно; в шумном помещении это работает хуже, чем в демо. И на Free его нет вообще.
  • Голосом легче согласиться, чем прочитать. Управление работами через речь снижает трение — включая трение перед подтверждением действия. Если у агента включены авто-подтверждения команд, голосовой интерфейс делает опасный сценарий ещё удобнее. Прямо сейчас это стоит держать в голове вместе с атакой Agent Data Injection.
  • Аудио-стек OpenAI под деприкейтом. 20 июля объявлено, что легаси-семейства audio, realtime и транскрипции выключат 20 января 2027: gpt-realtime уедет на gpt-realtime-2.1, gpt-audio и gpt-4o-audio — на gpt-audio-1.5. Если ты строил свой голосовой интерфейс на этих моделях, сроки уже идут.
  • GPT-Live всё ещё не отдали в API. Голос в продукте есть, возможности повторить его у себя — пока нет.

Альтернативы

  • Claude Code с голосовым вводом через сторонние инструменты — диктовка вместо управления: наговариваешь промпт, дальше всё как обычно. Гибче по моделям, но координировать несколько тредов голосом не выйдет.
  • Локальные связки на Whisper и открытых TTS — вроде Voicebox, про который мы писали: всё на твоей машине, никакой подписки и утечки аудио, но full-duplex и понимания контекста экрана нет.
  • Codex CLI без GUI — если голос не нужен, вся ценность релиза достаётся из терминала: /import, стабильный мультиагентный режим и история тредов работают там же.

Вердикт

Ставить обновление стоит ради двух вещей, и голос среди них не первый: /import в CLI 0.145.0 снимает главный барьер миграции с Cursor и Claude Code, а стабильный мультиагентный V2 позволяет наконец разнести дорогую и дешёвую модели по ролям. Голосовой режим бери, если работаешь один в тихой комнате на маке — там Screen context превращает его из игрушки в рабочий инструмент. В опенспейсе или на Windows он останется демо. А мультипапочные проекты включай только после того, как решишь, чей AGENTS.md победит.

Как попробовать

  1. Обнови десктопное приложение до 26.715 и включи голосовой режим в новом чате. На macOS сразу включи Screen context, иначе половина смысла теряется.
  2. Попробуй самый показательный сценарий: запусти долгую задачу в Codex, перейди в другой тред и голосом спроси, на каком она шаге.
  3. Собери мультипапочный проект: меню проекта → Edit project → добавь вторую папку → назначь основную. Сразу проверь, читается ли нужный AGENTS.md.
  4. Поставь CLI: npm install -g @openai/codex@0.145.0, запусти /import и посмотри, что подтянулось из Cursor или Claude Code — сессии и MCP-серверы переезжают тоже.
  5. Если гоняешь субагентов, задай им отдельную модель через настройки agents и проследи за расходом первые пару прогонов: предупреждение про Ultra и высокую конкурентность там появилось не просто так.
  6. Полный список изменений — в чейнджлоге Codex.
$ ls ./related/

Похожие статьи

claude-code-fresh-info.md
Claude советует код, которого уже нет. Как научить его искать самое свежее
> · 11 мин

Claude советует код, которого уже нет. Как научить его искать самое свежее

Claude по умолчанию отвечает из обучающих данных с отсечкой (у Fable 5 это январь 2026) и советует снятые API и несуществующие версии. Собрал рабочие приёмы, чтобы он лез в актуальные доки и веб: встроенный поиск с датовой привязкой, MCP context7, правила в CLAUDE.md, своя команда /latest, субагенты и хуки. Плюс честно про то, где это окупается, а где только жжёт токены.

ai claude-code mcp productivity
coding-benchmarks-retrieval.md
80% на SWE-bench это не 80% решённых задач: как кодинг-лидерборды меряют ретривал, а не кодинг
> · 9 мин

80% на SWE-bench это не 80% решённых задач: как кодинг-лидерборды меряют ретривал, а не кодинг

Четыре работы за месяц показали, что кодинг-лидерборды меряют ретривал и обвязку, а не кодинг: OpenAI зарубила два своих бенчмарка, Cursor нашёл 63% найденных фиксов, RuBench поймал GPT-5.6 на добывании ответов с диска. Плюс инструкция, как честно померить агента на своём репозитории.

ai llm benchmarks coding
wordpress-rce-gpt-56.md
GPT-5.6 нашла unauth RCE в ядре WordPress за $25 и 10 часов. Патч уже вышел, эксплойты уже в деле
> · 9 мин

GPT-5.6 нашла unauth RCE в ядре WordPress за $25 и 10 часов. Патч уже вышел, эксплойты уже в деле

Исследователь Searchlight Cyber с помощью GPT-5.6 за ~10 часов и $25 нашёл pre-auth RCE-цепочку в ядре WordPress. Разбираем экономику находки без рецепта атаки, почему $500k это фрейминг, и главное: как проверить свой сайт и защититься, ведь эксплойты уже в деле.

ai security gpt wordpress
subscribe.sh

$ cat /dev/blog/updates

> Свежие заметки о программировании,

> DevOps и AI — прямо в мессенджер

./subscribe