Codex Autoresearch
Плагин Codex для измеряемых экспериментов в репозитории: базовая метрика, проверка мелких правок и патч с доказательствами
Средний риск
Средний уровень ставим, когда инструмент запускает код, ходит в сеть или читает файлы проекта. Перед установкой посмотрите, что именно он делает.
Почему такой уровень
- Запускает заданные команды бенчмарка и проверок
- Может создавать коммиты и чистить пути эксперимента в заданных границах
Установка
Ручная установка
codex plugin marketplace add TheGreenCedar/AgentPluginMarketplace --ref mainРегистрирует маркетплейс, если сборка Codex умеет это из терминала. Затем установите плагин через /plugins.
Это чужой код. Посмотрите файлы в репозитории перед установкой.
Что делает
Плагин запускает в Codex короткие циклы улучшения кода по измеримой цели. Вы задаете нагрузку, проверки корректности, границы правок и бюджет времени, плагин фиксирует базовую метрику и перебирает небольшие изменения. Каждый шаг сравнивается с эталоном, результат журналируется как база, удача, отказ или сбой. По итогу остается патч на ветке с доказательствами, все прогоны видны на локальной read-only панели. Подходит для задач вроде ускорения тестов, снижения времени сборки, памяти или задержки.
Для кого. Для разработчиков и инженеров, которые улучшают код по числовой метрике и хотят воспроизводимость.
Подходит, если
- Есть измеримая цель и много вариантов правок для перебора
- Нужно ускорить тесты, сборку или снизить память по стабильному бенчмарку
- Нужен патч с журналом попыток и доказательствами
Не подходит, если
- Задача разовая или дело вкуса, а не числа
- Бенчмарк слишком медленный и шумный, повторное измерение мало что дает
Пример запроса к агенту
/goal @Codex Autoresearch запусти измеряемый цикл, чтобы ускорить парсер. Benchmark: node bench/parser.mjs. Метрика: секунды, меньше лучшеОграничения
Работает внутри Codex, поэтому нужен доступ к Codex. Бенчмарк должен печатать метрику строкой вида METRIC seconds=12.34. Плагин может создавать коммит в заданных границах и чистить рабочие пути эксперимента, финализация начинается с read-only предпросмотра. Состояние сессии хранится в проекте, в git это .git/autoresearch.
Как отключить. Удалите плагин codex-autoresearch через управление плагинами Codex.
Проверка безопасности
- Запускает заданные команды бенчмарка и проверок
- Может создавать коммиты и чистить пути эксперимента в заданных границах
Коротко о README
README описывает плагин Codex для воспроизводимых экспериментов над локальным кодом. Вы принимаете контракт: цель, проверки, границы и бюджет, дальше плагин меряет базу и перебирает правки, ведет журнал и оставляет обозримый патч. Версия 3.0 поддерживает и ограниченные исследования, где известен результат, но не выбран метод. Установка через пикер /plugins или регистрацию маркетплейса. Есть опциональная read-only панель. Лицензия Apache-2.0.
Частые вопросы
Что должен печатать бенчмарк?
Минимум одну строку с метрикой, например METRIC seconds=12.34. Она решает, сдвинулся ли результат в нужную сторону.
Может ли плагин менять git?
Да, в заданных границах: удачный результат может создать коммит, финализация начинается с предпросмотра без записи.
Похожие
Набор скиллов, который задает агенту процесс разработки: уточнение задачи, план, TDD, субагенты и ревью кода
Скиллы Мэтта Покока для инженеров
Skills For Real Engineers
Небольшие компонуемые скиллы для инженерной работы с агентом: интервью по плану, TDD, диагностика багов, ревью и архитектура
Набор GitHub для разработки от спецификации: CLI specify ставит в проект команды и скиллы для агента, от принципов до реализации
Референсные MCP-серверы
Model Context Protocol servers
Официальные референсные MCP-серверы: Filesystem, Fetch, Git, Memory, Sequential Thinking, Time и Everything