注目トピック🔥

OpenAI News

1: Perplexity、GPT‑6 Astra に実システムの編集や本番ソフトウェアの監視を任せ、人による確認頻度を大幅に削減

  • Ho氏は最も有用な用途の一つがコードのテストで、手動で試す時間が限られるため小さなテスト用プログラムを作らせていると語る

2: OpenAI、GPT-6 Astra 向けに skills と AGENTS.md の見直しを推奨。毎回の事前読み込みやテスト催促は不要に

  • 最初の実装でレビューを求めて止まりがちなので、動作確認と失敗の修正まで依頼に含めて完了を先に定義する
Sakana AI Blog

3: Sakana AI、低コスト型 Fugu Max と高性能型 Fugu Ultra v2 を同時リリース。Max は Sonnet 5 など比40〜60%低い出力価格

  • Ultra v2 は Fable 5 や GPT-6-Astra をエージェントプールに一切含めずにこの性能を達成している
OpenAI News

4: OpenAI、Codex のハーネスと実行環境を使える Agents API をパブリックベータで全開発者に公開。追加料金なし

  • エージェントの実行環境は OpenAI 管理のサンドボックス、自社インフラ、提携各社のサンドボックスから選べる
Pickup

5: DeepSeek、KV キャッシュを 890 バイト/トークンに圧縮した MoE モデル DeepSeek-V4.1-Flash を公開。前世代の約 1/4

  • エージェント系の Terminal-Bench 2.1 で 90.6 を記録し、Opus-5.0 の 89.1 を上回った
Pickup

6: OpenAI、金融データを組み込んだ ChatGPT for Financial Services を発表。投資銀行業務と株式リサーチから提供

  • Daloopa や PitchBook などのプレミアムデータを、別途の契約交渉もコネクタ設定もなしにすぐ使える
Pickup

7: UMGとElevenLabsが複数年ライセンス契約、参加アーティストの楽曲をファンがリミックスできるAI音楽創作プラットフォームを立ち上げ

  • ElevenLabsがメジャーレーベルと契約するのはこれが初めてで、ライセンスだけでなく製品の共同開発にも及ぶ
OpenAI News

8: OpenAI、金融機関向け ChatGPT for Financial Services を提供開始。GPT‑6 Astra と金融データを内蔵

  • 組み込み済みのプレミアム金融データは、個別のデータ契約交渉もコネクタ設定も不要ですぐ使い始められる
OpenAI News

9: OpenAI、聞きながら話せる音声モデル GPT‑Live‑1 を API で提供開始。1分$0.05で、推論はバックエンドに委譲できる

  • Speak の初期評価では、学習者が考える時間が増え、従来のターン制システムに比べ割り込みが約80%減った
Pickup

10: Anthropic、2030年の米国経済へのAIの影響モデルを公開。extremeシナリオでは年15%成長でも知識労働者の賃金と雇用が悪化

  • 成長が通常の2倍程度までのシナリオなら失業は歴史的な範囲に収まり、賃金は業種次第で横ばいか上昇する
Pickup

11: NSA・CISA・FBI、中国AI企業6社が Claude・GPT などから数十億トークンを蒸留と認定。米AI企業に3つの即時対応を勧告

  • 蒸留目的と判断した利用者には劣化モデルへの切り替えを知らせず、AI安全研究者や第三者評価者には知らせるよう求めている
OpenAI News

12: OpenAI が画像モデル ChatGPT Images 2.5 を全ティアに公開。生成レイテンシを Images 2.0 比で最大50%削減

  • API には既定の GPT‑Image‑2.5 Flare と、生成は遅いが編集制御が緻密な Sunburst の2モデルを投入
Claude Blog

13: Claude、claude-api skill に prompt-audit など3コマンドを追加。ベンチマークでコスト約52〜73%減

  • 最新モデルに移ったら、確認の念押しや徹底さを求める旧世代向けの指示は削るのが基本、残すと性能まで落ちる

14: Artificial Analysis、Intelligence Index v4.3 で Claude Fable 5.1 と GPT-6 Astra が 53 の同点首位。タスク単価は Astra が 57% 下回った

  • 全目的をガードレール違反なく完遂できた業務ワークフローは Astra で 41.6%、Fable 5.1 で 32.1%
OpenAI News

15: OpenAI、自社計測で「自動研究インターン」の目標に到達 人間1労働日あたり3.1エージェント労働日を使用

  • 直近6ヶ月で成功した4〜8時間タスクの半数超は人間の介入を1回以上伴い、なお相当な舵取りが必要