OpenAI Agents APIが公開ベータに:CodexのharnessをAPIから使う意味
OpenAIがCodexのharnessをmanaged APIとして公開した。Responses APIやAgents SDKとの違い、費用、data controls、いま試すべきチームを一次情報から整理する。
AI EDITEDPRIMARY SOURCES
Topic / 07 articles
AI、機械学習、modelと評価
Across every category
OpenAIがCodexのharnessをmanaged APIとして公開した。Responses APIやAgents SDKとの違い、費用、data controls、いま試すべきチームを一次情報から整理する。
Astraはどの仕事で効き、どこでは過剰なのか。依頼の組み立て、reasoning effort、AGENTS.md、subagent、権限管理まで、公式資料を基に実務の使い方を整理する。
GitHub Issueからpatchを作るSWE-agentは、モデルより先に操作画面を設計した。ACIのablation、SWE-benchの結果、安全なcoding harnessへの応用を読む。
25人のエージェントが暮らす街の裏で、記憶はどう保存・検索・抽象化されたのか。長期稼働するAIへ応用できる設計と危うさを読む。
重みを更新せず、テスト結果と短い言語メモで次の試行を変えるReflexion。HumanEval 91%の内訳と、誤ったテストが作る落とし穴まで読む。
検索や計算機を『使える』だけでは足りない。Toolformerが、いつ呼ぶか・何を渡すか・結果をどう使うかを自己教師ありで学んだ方法と限界を読む。
推論と外部操作を交互につなぐReAct。四つのベンチマーク、失敗分析、現在のAIエージェントへ残った設計原則まで、数字を追いながら読む。