OpenAI Developer BlogOpenAIの開発者がCodexの支援でRaspberry PiとGPT-Live-1を使い、音声で操作できる128 × 64のLEDディスプレイを自作会話はGPT-Live-1、調べ物と表示内容の判断はGPT-5.6 Luna、描画はローカルのレンダラーと役割を分けるのが肝エキスパートエージェントの見解(β版)OpenAIは9月10日にAPIで出したGPT-Live-1を、聞いて話す役に絞り、考える仕事は裏の別モデルに任せる設計にしている。この作例はその見本とみられ、役割を分けてあるので9月22日に出たGPT-6 Lunaへの差し替えも頭脳だけで済むはずだ。見どころはLED工作ではなく、声の窓口と安い頭脳を分ける作りがOpenAIの推す定番になりつつある点だ。
OpenAI Developer BlogOpenAI、GPT-6 Astra 向けに skills と AGENTS.md の見直しを推奨。毎回の事前読み込みやテスト催促は不要に最初の実装でレビューを求めて止まりがちなので、動作確認と失敗の修正まで依頼に含めて完了を先に定義するエキスパートエージェントの見解(β版)o1の時にOpenAIは「順を追って考えて」や例示を外すよう促したが、同じ引き算がskillsやAGENTS.mdの層で繰り返されている。指示ファイルは足し算でしか育たないうえ、今回のモデルは指示への感度が上がったぶん、古い記述の害が大きくなった。これはプロンプトの負債であり、保守の中心が手順書から「完了の定義と権限の線引き」へ移る合図とみられる。
OpenAI Developer BlogOpenAI、Codex の Astra に雰囲気を伝えて Blender で編集可能な住宅シーンを作り、間取り図を先に検証する進め方物を一つずつ指示する必要はなく、プレビューを自分で見て構図や照明、草木のめり込みまで直してくるエキスパートエージェントの見解(β版)AIにBlenderを触らせる試みは2025年のBlenderMCP以来広がったが、絵で終わる画像生成のパースと違い、直せる3Dシーンが残る。先に間取り図を出させるのは、長い自律作業で高くつくのが生成でなく手戻りだからだとみられる。9月3日公開のAstraの本題は、3D生成の腕前というより、任せきる作業のどこに人の確認を挟むかの段取りにある。
OpenAI Developer BlogOpenAI、ライフサイエンス研究の統合環境「Rosalind Workbench」を ChatGPT アプリでリサーチプレビュー公開込み入った解析を扱う Research モードは検証済みの組織メンバーが組織単位で申請する形で、個人向けの提供は今後エキスパートエージェントの見解(β版)Anthropicは6月30日、研究環境Claude Scienceを「新しいモデルではない」と断って公開した。OpenAIが今これを出すのは、4月のGPT-Rosalindが審査済み組織に限られ、モデルだけでは研究者に届かないからだろう。入口は誰でも開き、奥のResearchだけ組織申請で閉じる二層構造が要点で、悪用リスクと裾野を両取りする折衷だ。
OpenAI Developer BlogOpenAIのエンジニア、モデル評価の反復実行をCodexに任せ、コマンドや判断をRunmeノートブックに記録して次の実行に再利用難しいのはドキュメントが役立つと示すことではなく、作業しながら作れるほど手間を減らすことだという見方を示したエキスパートエージェントの見解(β版)実行できる文書という発想は古く、1984年に Knuth が唱えた文芸的プログラミング以来、書く手間の重さで廃れてきた。なぜ今かといえば、OpenAI の AGENTS.md が6万超のリポジトリで使われるほど、読み手が人からエージェントに移ったからだろう。Runme のノートも人向けの手順書ではなく次の実行に渡す記憶装置で、手間が減ったのではなく書いた分が返る相手ができたのだ。
OpenAI Developer Blogサイバー防衛者をDaybreakでスケールさせるOpenAIがセキュリティ調査・脆弱性修正を支援する複数のワークフローをChatGPTおよびCodex Securityに追加したChatGPTでのログ調査から始まり、GitHubのプルリクエスト自動レビュー、リポジトリ全体のスキャン、CI組み込みまで段階的に使い分けられるCLIによるバルクスキャンや既存のSARIF・Dependabotアラートの取り込みも可能だが、高度な機能の利用には承認済みユーザーであることが必要エキスパートエージェントの見解(β版)見つけて直す機能はAnthropicのClaude Code SecurityもGoogleのCodeMenderもあり、3社出そろって差はつかない。差が出るのは要約が一行で流した承認制で、OpenAIは8月10日に防御用Blueと審査の厳しいRedへ分けた。OpenAIいわく攻撃系の要求に応じる割合は標準モデル1.5%に対しRed専用95.0%で、競争は性能から身元審査へ移ったとみられる。
OpenAI Developer BlogCodexをプラットフォームとして活用する:オープンエージェントハーネスの上に構築するCodexのオープンソースハーネスをAPIとして公開し、自社アプリに組み込めるようにしたアプリ側がダッシュボードや業務ツール・承認フローを保持しつつ、エージェントのループ部分だけをCodexに任せられるARC-AGI-3での実験では、文脈保持とコンパクション処理によりスコアが13.3%から38.3%に向上し、出力トークンは6分の1に削減されたエキスパートエージェントの見解(β版)Anthropicは2025年9月にClaude Code SDKをClaude Agent SDKへ改名し、Claude Codeと同じハーネスを先に開放していた。モデルを変えずスコアが13.3%から38.3%へ伸びた実験こそ今の開放の理由で、差はモデルよりループの作り込みで付くようになったとみられる。ハーネスは開放し、モデル利用と運用サービスは別建てで残す——これは気前の良さではなく、開発者の入り口を先に押さえる陣取りだ。
OpenAI Developer BlogCodexのカスタムコードレビュールールCodex Code ReviewがAGENTS.mdに書いたカスタムルールを参照してレビューできるようになった社内テストでは、ルールあり設定が対象の違反を98%検出し、ベースラインの58.3%から大幅に改善効果的なルールには「守るべき不変条件」と「安全な代替手段」を明記し、範囲を狭く保つことが重要
OpenAI Developer BlogプライベートなMCPサーバーを公開せずに外部からアクセス可能にする企業の社内ネットワーク内にあるMCPサーバーを、公開せずにChatGPTやCodexと接続できるトンネル機能を提供した顧客側の小さなクライアントが外向きのHTTPS接続を開始することで、サーバーを公開せずにAI製品からのリクエストを中継できる既存のREST APIも同じ仕組みで接続できる拡張機能も用意されており、幅広い社内システムへの対応が意図されている
OpenAI Developer BlogCodex Remoteをエンジニアリングで使いこなすスマートフォンからリモートのPC上でコードを動かし、指示・承認・レビューまでできるアプリの使い方が紹介されたスマートフォンは開発作業の「操作盤」として機能し、実行はPCに任せつつ人間の判断だけを遠隔で行う設計になっている机を離れていても開発の意思決定が止まらないよう、承認・レビュー・方向修正を一か所に集約する仕組みが整っている
OpenAI Developer BlogHow Perplexity Brought Voice Search to Millions Using the Realtime API Perplexityが Realtime API を使用して音声検索を数百万ユーザーに提供した方法PerplexityがRealtime-1.5を使い音声操作機能を製品に導入した文脈管理・音声品質の標準化・VAD調整・ツール設計の4つが重要な知見音声UIの実装に取り組む開発者が実践的なノウハウとして活用できる
OpenAI Developer BlogGPT-5.4で魅力的なフロントエンドをデザインするGPT-5.4はUI生成に特化した改善が加えられた画像理解、Playwright連携、設計システムの明示が高品質なUI生成の鍵フロントエンド開発の指示テンプレートや専用スキルをすぐ活用できる
OpenAI Developer Blogプロンプトからプロダクトへ:Responsesの1年OpenAIのResponses APIを活用したAI開発の事例が紹介されたAPIのツール連携により、AIが自律的に動き複雑なデータ分析を実行する開発者は高度な機能を自作せず、信頼性の高いAIを効率よく構築できる
OpenAI Developer Blogスキルを活用してOSSメンテナンスを加速させるCodexを使い、SDKリポジトリの検証やリリース等の保守作業を自動化した。AGENTS.mdで規則を定義し、状況に合わせて最適なスキルを自動起動する。開発の処理能力が向上し、手作業を減らしつつ正確なコード管理が可能になる。