Codex Autoresearch

Скилл для Codex, который ведет цикл измеримых экспериментов над репозиторием к числовой цели: правка, проверка, откат неудач, повтор

Скилл

Высокий риск

Высокий уровень ставим, когда инструмент пишет во внешние системы, работает с деньгами, рабочими базами или секретами либо выполняет произвольные команды. CLI поставит его только после вашего согласия.

Почему такой уровень

  • Автономно меняет код, создает и откатывает коммиты git
  • Запускает произвольные команды метрики и по умолчанию требует полного доступа
Все причины и проверки

leo-lilinxiao/codex-autoresearch

Установка

В терминале, через SkillFoxx CLI

npx skillfoxx add skills/codex-autoresearch

Определит агенты на машине, проверит риск и зафиксирует версию.

Другие способы установки

Выполните в терминале в папке проекта

npx skills add leo-lilinxiao/codex-autoresearch --skill codex-autoresearch -a claude-code -y

Утилита skills ставит текущую версию из репозитория. Чтобы скилл работал во всех проектах, добавьте флаг -g.

Выполните в терминале в папке проекта

npx skills add leo-lilinxiao/codex-autoresearch --skill codex-autoresearch -a cursor -y

Утилита skills ставит текущую версию из репозитория. Чтобы скилл работал во всех проектах, добавьте флаг -g.

Выполните в терминале в папке проекта

npx skills add leo-lilinxiao/codex-autoresearch --skill codex-autoresearch -a github-copilot -y

Утилита skills ставит текущую версию из репозитория. Чтобы скилл работал во всех проектах, добавьте флаг -g.

Выполните в терминале в папке проекта

npx skills add leo-lilinxiao/codex-autoresearch --skill codex-autoresearch -a codex -y

Утилита skills ставит текущую версию из репозитория. Чтобы скилл работал во всех проектах, добавьте флаг -g.

Выполните в терминале в папке проекта

npx skills add leo-lilinxiao/codex-autoresearch --skill codex-autoresearch -a gemini-cli -y

Утилита skills ставит текущую версию из репозитория. Чтобы скилл работал во всех проектах, добавьте флаг -g.

Выполните в терминале в папке проекта

npx skills add leo-lilinxiao/codex-autoresearch --skill codex-autoresearch -a cline -y

Утилита skills ставит текущую версию из репозитория. Чтобы скилл работал во всех проектах, добавьте флаг -g.

Выполните в терминале в папке проекта

npx skills add leo-lilinxiao/codex-autoresearch --skill codex-autoresearch -a roo -y

Утилита skills ставит текущую версию из репозитория. Чтобы скилл работал во всех проектах, добавьте флаг -g.

Форк Roo Code, папки .roo те же.

Выполните в терминале в папке проекта

npx skills add leo-lilinxiao/codex-autoresearch --skill codex-autoresearch -a opencode -y

Утилита skills ставит текущую версию из репозитория. Чтобы скилл работал во всех проектах, добавьте флаг -g.

Понадобится: Node.js

Сверено с репозиторием 24 сент. 2026, коммит 0f54c57.

Текст для агента

В Codex выполни $skill-installer install https://github.com/leo-lilinxiao/codex-autoresearch, открой чистую ветку git с полным доступом, затем вызови $codex-autoresearch и назови метрику, цель, границы правок и режим.

Другие способы из описания автора
$skill-installer install https://github.com/leo-lilinxiao/codex-autoresearch

Команда вводится внутри Codex через встроенный установщик скиллов. Затем откройте целевой репозиторий и вызовите $codex-autoresearch.

Это чужой код. Посмотрите файлы в репозитории перед установкой.

Что делает

Скилл дает Codex дисциплину автономной оптимизации репозитория к заданной числовой метрике. Пользователь называет измеримый результат, например ноль ошибок теста, меньше предупреждений, ниже задержка или размер бинарника, а скилл повторяет цикл: меняет одно, измеряет командой проверки, оставляет улучшение или откатывает через git revert. Управляющий скрипт владеет коммитами, проверкой, откатом и историей событий, а Codex отвечает за гипотезы и правки кода. Перед первой записью скилл подтверждает цель, границы правок, команду метрики, необязательный контроль регрессий и режим работы, в переднем плане или в фоне. Результат complete ставится только когда сохраненная метрика достигает подтвержденной цели, а вся история пишется в autoresearch-results.

Для кого. Для разработчиков и инженеров качества, которым нужна автономная итеративная оптимизация кода под измеримую цель.

Подходит, если

  • Нужно довести метрику до цели: ноль падающих тестов, меньше предупреждений, ниже задержка
  • Нужен длинный автономный прогон правок с проверкой и откатом на каждом шаге
  • Нужна воспроизводимая история экспериментов с коммитами и журналом

Не подходит, если

  • Нужна разовая правка, а не цикл измеримых экспериментов
  • Результат нельзя выразить одной числовой командой проверки
  • Нет чистой ветки git или git использовать нельзя

Пример запроса к агенту

Доведи error_count из python3 scripts/score.py до нуля, меняй только src, работай в фоне

Ограничения

Работает только с Codex, нужны Python 3.11 и выше, git и настроенная авторская подпись. Один прогон это один репозиторий, одна метрика и одна чистая именованная ветка, без git скилл не работает, поскольку git это память экспериментов и граница отката. Команда метрики должна завершаться успешно и выводить одно конечное число или JSON с явно названным ключом. Фоновые прогоны по умолчанию требуют полного доступа, потому что каждый шаг создает или откатывает коммит.

Как отключить. Удалите папку codex-autoresearch из каталога скиллов, обычно .agents/skills в проекте или ~/.agents/skills. Каталог autoresearch-results в репозитории проекта можно удалить отдельно.

Проверка безопасности

  • Автономно меняет код, создает и откатывает коммиты git
  • Запускает произвольные команды метрики и по умолчанию требует полного доступа

Коротко о README

README описывает автономную систему для Codex, которая циклично улучшает репозиторий к числовой цели и вдохновлена идеей autoresearch Карпаты. Пользователь называет измеримый результат, Codex осматривает репозиторий, подтверждает эксперимент, меняет одно, проверяет и оставляет удачное или откатывает неудачное. Установка идет через $skill-installer или ручным копированием в каталог скиллов, а прогон открывается на чистой ветке git с полным доступом. Артефакты прогона лежат в autoresearch-results: неизменяемая конфигурация, журнал событий, логи и необязательный HTML-отчет. Каждая попытка это коммит, любая непройденная проверка откатывается через git revert, а строгая модель безопасности останавливает прогон при выходе за границы или сбое. Лицензия MIT.

SKILL.md

---
name: codex-autoresearch
description: "Run repeated, measured Git experiments toward a numeric target; keep improvements and revert failures. Use for autonomous optimization or managing an autoresearch run, not one-shot edits."
metadata:
  short-description: "Run measurable autonomous experiments"
---

# Codex Autoresearch

Improve a repository through repeated, reversible experiments:

`hypothesize -> change -> measure -> learn -> keep or revert -> repeat`

Codex chooses hypotheses and makes code changes. The control script owns measurement, commits, rollback, and the event history.

## Respond To The Request

Resolve `<control>` to this skill's own `scripts/autoresearch.py`; do not assume it is installed in the target repository.

For a status or results request, run the corresponding command directly:

| Request | Command |
|---|---|
| Status | `python3 <control> status --repo <repo>` |
| History | `python3 <control> history --repo <repo>` |
| TSV export | `python3 <control> history --repo <repo> --format tsv` |
| HTML report | `python3 <control> report --repo <repo>` |

## Experiment Boundary

- One run owns one Git repository, one numeric metric, one confirmed target, and approved path scopes.
- Use `finish` to finalize each coherent experiment.
- Only a verified target can mean `complete`; an iteration limit, error, or external blocker has its own status.

Частые вопросы

Установка меняет настройки Codex?

Нет, установка только копирует файлы скилла. Для работы переднего плана нужна свежая версия Codex с поддержкой целей.

Можно остановить и продолжить прогон?

Да. Передний прогон приостанавливается через цель Codex, фоновый управляется через $codex-autoresearch: статус, стоп или продолжение подтвержденного эксперимента.

Выбор редакции

Набор скиллов, который задает агенту процесс разработки: уточнение задачи, план, TDD, субагенты и ревью кода

ПлагинСредний рискБез VPN292,5 тыс.Звезды репозитория
Выбор редакции

Небольшие компонуемые скиллы для инженерной работы с агентом: интервью по плану, TDD, диагностика багов, ревью и архитектура

СкиллНизкий риск271,4 тыс.Звезды репозитория
Выбор редакции

Набор GitHub для разработки от спецификации: CLI specify ставит в проект команды и скиллы для агента, от принципов до реализации

CLIСредний рискБез VPN139,3 тыс.Звезды репозитория

Референсные MCP-серверы

Model Context Protocol servers

Официальный

Официальные референсные MCP-серверы: Filesystem, Fetch, Git, Memory, Sequential Thinking, Time и Everything

MCP-серверСредний риск90,6 тыс.Звезды репозитория
Foxx AICodex Autoresearch

Я Foxx AI и уже разобрал этот инструмент. Спросите про установку, настройку или что угодно еще, отвечу простыми словами.