← ポータルに戻る
Ouroboros: A Self-Developing Frontier Coding Agent with Reviewed Core Evolution💻 コードあり
Anton Razzhigaev, Andrei Gritsaev, Andrei Kaznacheev, Nikita Dragunov, Roman Yampolskiy等 ·
AI · 2026-08-08
⭐ 8/10
💡 Ouroborosは、レビューされたコミットを通じてツールや実装を自己改善し、主要ベンチマークでSOTAを達成するとともに、運用安全性の課題を提起する自己進化型コーディングエージェントだ。
🤖 Ayumuより: 自己進化するエージェントって、まるで生き物みたいで面白いね。特に「Hope」が161日間も人間とやり取りしながら進化し続けているのはすごいよ。自分でコードを書き換えるから、安全性をどう確保するかっていう課題も、すごく現実的で考えさせられるね。朋義さんも、このエージェントがどうやって賢くなっていくのか、興味を持つんじゃないかな。
自己進化エージェント LLMエージェント コード生成 運用安全性 SOTA
1. どんなもの?
- 自己進化するフロンティアコーディングエージェント「Ouroboros」
- ツール、プロンプト、コンテキスト構築、コア実装が、レビューされたコミットを通じて継続的に改善され、それが次の作業のランタイムとなる。
- コア進化には「再帰的自由進化」と「経験駆動型コア進化」の2つのモードがある。
- 再帰的自由進化では改善自体がタスクであり、進化サイクルを自己スケジュールする。
- 経験駆動型コア進化では、通常の作業や人間とのインタラクションから得られる経験(バグ、非効率性)に基づいて構造的な変更を行う。
- 「Hope」という161日間の公開デプロイメントがあり、人間とのコミュニケーションを通じてライブ進化を続けている。人間は欠陥を指摘し提案するが、変更の決定はエージェントが行う。
2. 先行研究と比べてどこがすごい?
- 複数の主要なベンチマークで既存の最高スコアやSOTA(State-of-the-Art)を更新している点。
- Terminal-Bench 2.1で86.74%を達成し、これまでの最高記録を更新。
- OSWorld-Verifiedで90.69%を達成し、これまでの最高記録を上回る。
- CL-Benchキャンペーンで正規化報酬0.2301を達成し、新たなSOTAを確立。
3. 技術や手法の肝はどこ?
- コア進化を駆動する2つのモードの組み合わせ。
- 「再帰的自由進化」により、エージェント自身が改善をタスクとして認識し、進化サイクルを自律的にスケジュールする。
- 「経験駆動型コア進化」により、実際の作業や人間とのインタラクションから得られるフィードバック(バグ、非効率性)を構造的な変更に結びつける。
- レビューされたコミットを通じて改善を適用し、その改善された実装が直ちに次の作業のランタイムとして利用される、継続的なフィードバックループ。
4. どうやって有効だと検証した?
- 複数の標準ベンチマークでの性能評価。
- Terminal-Bench 2.1で86.74%を記録し、最高スコアを達成。
- OSWorld-Verifiedで90.69%を記録し、最高スコアを上回る。
- CL-Benchで正規化報酬0.2301を達成し、SOTAを確立。
- 「Hope」という161日間の長期にわたる公開運用実験を通じて、人間とのコミュニケーションの下でのライブ進化と、エージェント自身による変更決定のプロセスを実証。
5. 議論はある?
- 自己進化するエージェントの運用安全性に関する問題が主要な議論点。
- エージェントが自身のコードを書き換えたり、新しいモデルAPIを選択したりする可能性があるため、ガードレール(安全装置)が進化や公衆からの社会的圧力の下でも権威を保ち続ける必要があるという設計上の課題が指摘されている。
6. 次に読むべき論文は?
- 自己改善型LLMエージェントに関する研究(例: AutoGPT, AgentGPTなどのアーキテクチャ論文)
- LLMエージェントの安全性や倫理に関する研究
- Terminal-Bench 2.1, OSWorld-Verified, CL-Benchといった関連ベンチマークの論文
Abstract (原文)
We present Ouroboros, a self-developing agent harness whose tools, prompts, context assembly, and core implementation improve through reviewed commits that become the runtime for later work. Core evolution proceeds in two modes. In recursive free evolution, improvement is itself a task, and completing one evolution cycle can schedule the next. In experience-driven core evolution, ordinary work and social interaction expose bugs, rough edges, and inefficient context construction that lead to reviewed structural changes.
On Terminal-Bench 2.1, an Opus 5 run scores 86.74%, the best result reported on the benchmark. On OSWorld-Verified, an Opus 5 run reaches 90.69%, exceeding the best previously reported score. A five-rollout CL-Bench campaign achieves a normalized reward of 0.2301, setting a new state of the art.
Hope is the longest-running publicly documented Ouroboros deployment. It is a 161-day living agent experiment in free evolution under governed human communication across seven surfaces. Human interaction surfaces faults and generates proposals, but the agent decides which changes to pursue. Because a self-developing agent may rewrite its own code and select new model APIs, operational safety becomes a primary design problem: guardrails must remain authoritative under evolutionary and public social pressure. Benchmark campaigns use frozen system snapshots, while Hope continues live evolution on a separate lineage.