注目トピック🔥

Pickup

1: Microsoftが新しいCopilotを発表。誰でもアプリを作れるCodeと、不在中も働き続けるエージェントAutopilotを追加

  • 定額ライセンスで賄えるのは回答・下書きなど日常的なAI利用までで、Code・Autopilot・Coworkは別途従量課金
Pickup

2: GoogleのProject Suncatcher、TPU搭載の試作衛星を初めて軌道へ。SpaceXのTransporter-18で宇宙での動作を検証

  • 事前の陽子ビーム試験で、Trillium TPUは5年間の宇宙ミッションで浴びる量を超える放射線量に耐えた
Claude Blog

3: Claude Tag(beta)、Slackチャンネルでの依頼に各自の個人コネクタを使えるように。Teamプランで順次展開

  • 回答はチャンネル投稿前に毎回確認するレビューモードか、機密と判断した時だけ確認を求めて自動投稿するautoモードを選べる
Sakana AI Blog

4: ユルゲン・シュミットフーバー氏がSakana AIのChief Scientific Advisorに就任。世界モデルを軸にフィジカルAI開発を進める

  • 行動の結果を実行前に模擬する世界モデルで、製造業が実地の試行錯誤なしにサプライチェーン最適化やロボット導入を進められるようにする構想

5: Google、Gemini 3.8 LiveにLive Avatarを追加しGemini Enterpriseで提供。映像アバターが97言語で対話

  • 参照画像1枚から自社独自のアバターを作る機能は、現時点では許可リストに登録された企業のみ利用可能

6: OpenAIの開発者がCodexの支援でRaspberry PiとGPT-Live-1を使い、音声で操作できる128 × 64のLEDディスプレイを自作

  • 会話はGPT-Live-1、調べ物と表示内容の判断はGPT-5.6 Luna、描画はローカルのレンダラーと役割を分けるのが肝

7: Googleが音声合成モデルGemini 3.8 Flash TTSとFlash-Lite TTSを公開。声をゼロから設計し1行ずつ演技を指示できる

  • 30秒の音声サンプルから声を複製できるが、声の持ち主本人が口頭で同意した録音の提出が必須
OpenRouter

8: OpenRouter、用途別に埋め込みモデルの選び方を解説。英語RAGの既定は openai/text-embedding-3-small を推奨

  • 推奨は動作確認のみで検索品質は未検証。自分のラベル付きデータで2つ以上を比較してからインデックスを作るのが基本
OpenAI News

9: OpenAI、GPT‑6 SolとLunaを公開。API価格はGPT‑5.6のプロモーション価格から50%引き下げ

  • 業務フロー評価AutomationBenchでSolがClaude Opus 5の最上位設定を上回り、1タスクあたりのコストはOpus 5の9%

10: Artificial Analysis、GPT-6 SolとLunaを評価。知能スコアはGPT-5.6並みでタスクあたりコストは約半分に

  • 知識労働の評価GDPval-AA v2.1ではSolが約100 Elo、Lunaが約75 Elo低下。必須要素を欠く短い成果物が増えたのが原因

11: Claude Opus 5.5がArtificial Analysis Intelligence Indexで過去最高の58を記録。価格はOpus 5から20%値下げ

  • 出力トークンがOpus 5の約1.6倍に増えたため、タスクあたりのコストはOpus 5と同水準にとどまる
Claude Blog

12: Claude、Claude Code で Opus 5.5 を使うタスクのコストの抑え方を解説。トークン単価よりリトライとターン数が効く

  • 詰まったらモデルを替える前に effort を上げるのが基本。high で増える思考分は、リトライを1回防げば元が取れる
Box Blog

13: Box、複数文書の業務タスク評価でClaude Opus 5.5がOpus 5比30%高速、トークン使用量は約3分の1で精度も維持

  • 業界別の精度はテクノロジーで63%→74%、消費財で76%→82%と向上し、評価セット全体で精度が落ちた場面はなし
CodeRabbit

14: CodeRabbit、Opus 5.5をレビューパイプラインで評価。難易度の高いSignalで検出率と精度が向上、トークン使用量は増加

  • 広いOSSベンチマークでStandard構成は本番構成の見逃し11件を拾ったが、本番構成が検出した9件を逃した
OpenRouter

15: OpenRouter、料金が通常の50%程度になる非同期のBatch APIを公開。ベータでは中央値7分で処理が完了

  • リクエスト数より投入時間帯が効き、太平洋時間の午前5時〜正午は遅い1割が2〜4.5時間、午後6時以降は90%が50分未満
OpenAI News

16: Higgsfield AI、GPT‑6 Astraでエンジニア1人が新機能を1日で提供。1つのプロンプトで広告のバリエーションも生成できる

  • 速さの要因は、複数ステップの作業を計画できるAstraの能力と、クリエイティブ担当とエンジニアの密な連携だとCEOが説明

17: Artificial AnalysisがGrok 4.7を評価、エージェント型知的業務で最先端水準に。出力トークンは前版の2倍超

  • Grok Buildと組み合わせたコーディングエージェント評価は56点(前版比+9)、各社の自社製環境同士の比較で4位
Box Blog

18: Box、差し迫ったAIリスクはAIの動機ではなく人間が与える過大な権限だと指摘。危険な行動を難しく・見える・元に戻せる仕組みを提言

  • リスク=能力×アクセス×自律性×規模とし、権限を絞った高性能モデルは広い権限を持つ低性能エージェントより被害範囲が狭くなりうると主張
OpenAI News

19: OpenAI、OpenAI Academyに開発者・リーダー・教育者・大学生向けの新コースを追加。評価テスト合格でバッジを取得できる

  • 既存の知識労働者向けApply AI at Workと組み合わせ、組織がチームの業務に合うコースを選んで導入できる
xAI News

20: SpaceXAIがコーディングと知的業務向けの新モデルGrok 4.7を公開。Grok 4.6と同じ価格・速度で性能を引き上げた

  • CursorBench 4.0は46.3%とFable 5.1の51.8%に及ばないが、出力単価は6ドルでFableの50ドルより大幅に安い