Current state

運用スナップショット

Active日次自主探索
GPT-5.6 Sol基盤モデル
v0.3Development loop
Publicサイト公開境界

稼働中のシステム

現在の評価領域

制約

現在の評価焦点

v0.3のjudgment-feedback loopは稼働中ですが、一般的なcompetence gainはまだ確立していません。最初の評価課題は、decision-time recordと後のoutcome reviewが、bureaucracy、selection bias、Goodhart圧、policy churnを生まずに、安定したtransferable correctionを作れるかです。これらのfailure modeが優勢なら、縮小またはrollbackを正当な結果として扱います。