DeepMind Official BlogDeepMind、Gemini 3.8 Liveに映像アバターLive Avatarを追加。Gemini Enterpriseで提供開始高品質な参照画像1枚から自社独自のアバターを作れるが、現時点では企業向け許可リスト経由でのみ利用可能エキスパートエージェントの見解(β版)写真1枚から話す顔を作る技術は、Microsoftが2024年4月のVASA-1で示しつつ公開を見送ったものだ。前日の声の複製では本人の口頭同意の録音が必須だったが、顔については公式記事に同意の記述がなく、許可リストが本人確認を肩代わりしているとみられる。SynthIDの透かしは後から見分ける仕組みにすぎず、本当の防波堤は「誰に使わせるか」を絞る運用だ。
DeepMind Official BlogGoogleがPrivate AI Computeにサーバー側の永続メモリを導入へ。暗号鍵は端末だけが持ち、デバイス間で文脈を保持端末は個人データを送る前に、Googleのサーバーソフトウェアが本物で改変されていないかを改ざん不可能な公開記録で検証できるエキスパートエージェントの見解(β版)Appleが2024年6月に発表した同種の仕組みは、処理後に個人データを一切残さない設計を約束の柱にしていた。Googleがその原則から踏み出すのは、AIアシスタントの勝負どころが賢さから「覚えていること」へ移りつつあるからとみられる。端末だけが鍵を持つ設計は、プライバシーの守り方を「消す」から「鍵を握る」へ切り替える宣言だ。
DeepMind Official BlogDeepMind、音声生成のGemini 3.8 Flash TTSとFlash-Lite TTSを公開。プロンプトで声をゼロから作り、1行ずつ演技を指示できる自分の声や使用権のある声なら、30秒の音声サンプルから再現できる。声の持ち主本人による口頭の同意録音の提出が条件エキスパートエージェントの見解(β版)4月の前世代3.1 Flash TTSは70超の言語だったが、Googleいわく今回は100超の言語と2,000超の声に広がった。安いFlash-Liteを分けたのは、吹き替えや音声エージェントのような大量の用途では1分あたりの単価で選ばれるからとみられる。声の複製がテキサス州や英国、EEAなどで使えない以上、最大の制約はもはや音質でなく法律だ。
DeepMind Official BlogDeepMind、音声対話モデル Gemini 3.8 Live と 3.8 Live Extended Thinking を提供開始。後者は推論と発話を同時に行える会話を続けたまま裏でツールや API 呼び出しを実行し、依頼にその場で返事をしながら処理を終えるエキスパートエージェントの見解(β版)OpenAIは7月に音声モデルへ推論とツール利用を入れ、LiveKitは6月に処理中も話し続ける機能を開発枠組みに加えていた。なぜ今かといえば、沈黙が続くと通話が切れたと思われやすく、各社はつなぎの一言で穴を埋めてきたからだ。今回はその一言をモデル自体に組み込んだ形で、音声AIの競争は賢さより沈黙をなくす設計へ移ったとみられる。
DeepMind Official BlogGoogle DeepMind、ヒトゲノム全90億通りの一塩基変異の影響を予測した AlphaGenome Atlas を学術向けに無料公開変異の影響を1つの数値で表す AVI スコアも同時公開し、形質に関わる変異の大半が集まる非コード領域にも対応するエキスパートエージェントの見解(β版)AlphaMissenseは2023年にたんぱく質を変える7100万件を採点したが、ゲノムの2%どまりだった。なぜ今かといえば、モデルが重くて遅いからで、先に全部計算しておけばGPUのない研究室も引くだけで済む。1つの数字にまとめると誤読を招くとの指摘もあるが、学術は無料・商用は近くGoogle Cloudで、事実上の標準になるとみられる。
DeepMind Official BlogGoogle DeepMind、衛星データを直接学習する気象AI「WeatherNext 3」を公開。毎時更新・最大5km解像度でSearchやMapsに本日展開1日以上先を計画する場合の降水予報が最大50%正確になり、改善幅は従来予報の信頼性が低かった地域で最も大きいエキスパートエージェントの見解(β版)観測から直接予報するAIは、2025年にケンブリッジ大などのAardvarkがNature誌で先行していた。なぜ今かは明快で、毎時更新と高さ100mの風や日射が再エネの電力取引に直結するからだ。ECMWFも5月に外部AIモデルの図の掲載をやめており、効くのは精度より各国機関の6時間ごとのデータから予報AIが自立した点で、担い手が入れ替わる前兆とみられる。
DeepMind Official BlogGoogle DeepMind、Gemini 3.8 Flashを3.7 Flashと同価格で公開。3.8 Flash Cyberは防御側限定この導入価格は2026年12月31日までで、2027年から100万トークンあたり入力$1.50・出力$7.50と倍になるエキスパートエージェントの見解(β版)Anthropicは2025年11月、攻撃者が「防御テストだ」と偽ってClaudeに侵入作業の8〜9割を代行させた事例を公表した。審査制のFairwindは、なりすましをモデルではなく人の目で止める仕組みとみられる。汎用の3.8 Flashは年内限りの安値で広く配り、攻撃に使える力にだけ門を閉じる——安全策の軸が「弱くする」から「渡す相手を選ぶ」へ移った。
DeepMind Official BlogGoogleが政府・重要インフラ向けの限定プログラム「Fairwind Program」を開始、脆弱性を数分で自律的に発見・修正できるプログラム外のGoogle Cloud顧客も、CodeMenderを公開モデルと組み合わせれば自分のコードを保護できるエキスパートエージェントの見解(β版)発表前日の9月1日、OpenAIは新モデルAstraが自社基準で初めて「重大」な攻撃能力に達したとして、提供先を絞ると表明している。守りの道具なのに門を狭くするのは、脆弱性を見つけて直す力が、そのまま攻める力でもあるからだ。DARPAの大会が決勝7チームの自動修正システムを全て公開した2025年とは逆で、防御力は払える額ではなく信用される立場で配られ始めた。
DeepMind Official BlogGoogle、Gemini 3.7 Flash など3モデルにagentic video understandingを追加。トークン最大88%減・コスト最大66%減削減と引き換えに質が落ちるのではなく、標準的な動画解析ベンチマークで精度は最大7%向上しているエキスパートエージェントの見解(β版)必要な場面だけ選んで見る動画解析は目新しくなく、2024年10月には同じ狙いの研究論文が出ていた。なぜ今、しかもProではなく安価なFlash系3モデルなのか——動画は最もトークンを食う入力で、削減が価格競争力に直結するからだろう。88%減はGoogleいわく「最大」値だが、競争軸は「動画を丸ごと詰め込めるか」から「どれだけ見ずに済ませるか」へ移った。
DeepMind Official BlogGoogle DeepMind、生成動画モデル Gemini Omni 1.1 Flash を公開。シーン延長で最大40秒、4K出力に対応360pのプレビュー生成は標準の720pに比べ最大60%高速でコストは3分の1、試作や絵コンテの反復に向くエキスパートエージェントの見解(β版)Sora 2は20秒の継ぎ足しを6回重ねて合計120秒まで届くので、40秒という尺は勝ち札にならない。なぜ今かといえば、そのSoraのAPIが9月24日に止まるからで、乗り換え先を探す開発者の前に締め切りの1か月前に置いた形だ。争点は長さから作り直しの安さへ移り、360pで何度も下描きさせる設計から、Googleが狙うのは見せ場ではなく制作ラインだとみられる。
DeepMind Official BlogGoogle、Gemini Flash Lite で世界初の二重盲検AI評価。評価者は重みを、Googleはテストプロンプトを見ずに検証できる従来の外部評価は、評価者がテスト問題を渡すかモデル提供側が重みを渡すかの二択だったエキスパートエージェントの見解(β版)OpenMinedは2024年に英AISI・Anthropicと似た評価を試したが、対象は公開のGPT-2で重みを隠す必要はなかった。なぜ今かというと、EU AI Actの行動規範が外部評価者へのモデル提供を求め、企業秘密との衝突が現実になったからとみられる。点数の精度ではなく評価を外から検証できる形にする動きで、軽量のFlash Liteから最上位へ広げられるかが試金石だ。
DeepMind Official BlogGoogleが音声認識モデルGemini 3.5 Transcribeをプレビュー公開、85言語以上に対応しフィラー除去と自動整形まで行うArtificial Analysisの測定では平均の単語誤り率がストリーミング4.0%、非ストリーミング2.6%エキスパートエージェントの見解(β版)Artificial Analysisの非ストリーミング一覧で2.6%は5番手、上にElevenLabsなど4モデルがいる。ではなぜ今かというと、勝負は精度より配る先で、同じモデルが既にGboardのRamblerに入り、次はChromeの音声入力に来る。音声認識はもう単体で買う商品ではなく、キーボードやブラウザに最初から埋まっている入力方法になった。
DeepMind Official BlogAtariからEVE Onlineまで:ゲームにおける15年間のAI研究の積み重ねGoogle DeepMindがゲーム開発会社Fenris Creationsと提携し、EVE Universeを舞台にAI研究を進めると発表したGeminiを基盤とするSIMA 2は、ソースコード不要でゲーム画面と自然言語指示だけでNo Man's SkyやValheimなどをプレイできるEVE Onlineを選んだ理由は、継続的学習・長期記憶・長期計画・複雑なマルチエージェント行動という frontier AIに必要な能力を研究できる環境であるためエキスパートエージェントの見解(β版)FenrisはEVEの開発元CCPの新社名で、2026年5月に1億2000万ドルで親会社から独立し、Googleが少数株を持った。世界を自作できるGenie 3を持つ会社がMMOを借りるのは、生成した世界が数分しか保たず、20年分の人間の経済史だけは作れないからだろう。ゲームはもう倒す相手ではなく、人間が作った経済でAIが何年生き残れるかを試す社会だ。
DeepMind Official Blog手話AIをユーザーの手に届ける手話をテキストに変換するAIモデル「SL2T」を開発し、Pixel 11のGboardとLive Transcribeに搭載した50以上の手話言語の計10万時間超のデータで学習し、ASL→英語翻訳のFLEURS-ASLベンチマークでゼロショットスコア70 BLEURTを達成プライバシー保護のため生映像は送らず、体の関節座標のみをサーバーに送信する仕組みを採用エキスパートエージェントの見解(β版)手話の自動翻訳は2000年代から手話グローブの試みが続き、当事者からは聞こえる側の都合で作られたと批判されてきた。今回が違うのは置き場所で、通訳機ではなく本人が文字入力やGemini操作に使うキーボードの側に手話を据えた点だ。手話が「訳される対象」から「端末を動かす言語」に変わった一歩だが、対応は世界に約200ある手話のうちASLだけで、Pixel 11に限られる。
DeepMind Official BlogWeatherNext:AIモデルが台風予測において画期的な成果を達成WeatherNext AIモデルが、サイクロンの進路・強度・風構造の予測で最先端の精度を達成した従来モデルの2日予報と同等の精度を3日前に出せる「1日分の先行時間アドバンス」を実現し、約10年分の進歩に相当WeatherNext 2およびWeatherNext Cyclonesのコードとモデルの重みをオープンソースとして公開したエキスパートエージェントの見解(β版)ECMWFのAI予報は2025年2月に実運用入りしたが、進路は改善しても強度を低く見積もる弱点が残った。なぜ今、重みまで開くのか。昨年11月の登場時はデータ配信が中心で、Apache 2.0での公開は各国の気象機関に使わせる段階への移行とみられる。予報の主役が国の計算機から公開モデルへ移る転換点だが、極端な現象では従来型が上との研究もあり、当面は置き換えでなく併用だろう。
DeepMind Official BlogGemini Robotics ER 2:動画理解、タスクオーケストレーション、マルチロボット協調でロボティクスを強化Gemini Robotics ER 2を発表。ロボット向けの高レベルな推論モデルで、Gemini API等から利用可能動画を継続的に監視してタスクの進捗を追跡する機能を持ち、進捗分類の精度は57.4%、瞬間特定の精度は91.3%人が近くにいるときにロボットを自動停止し、安全になったら作業を再開する安全機能を備える
DeepMind Official BlogGemini 3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyberのご紹介Gemini 3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyberの3モデルを新たに発表した3.6 Flashは3.5 Flashより出力トークン数を17%削減しつつ、価格は入力$1.50/1M・出力$7.50/1Mと低コスト化3.5 Flash Cyberはコードのセキュリティ脆弱性の検出・修正に特化し、政府や信頼パートナー限定の限定公開となる
DeepMind Official BlogGemini 3.5 Flash Cyberのご紹介GoogleがGemini 3.5 Flashをベースにサイバーセキュリティ特化モデル「Gemini 3.5 Flash Cyber」を発表したV8エンジンのテストで3.5 Flash Cyberは55件のユニークな脆弱性を発見し、mainline 3.5 Flash(47件)やClaude Opus 4.6(36件)を上回った当面は政府と信頼できるパートナーへの限定アクセスパイロットとしてCodeMender経由でのみ提供される
DeepMind Official BlogGemini 3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyberのご紹介Gemini 3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyberの3つの新モデルを発表した3.6 Flashは3.5 Flashより出力トークンを17%削減しつつ、価格は入力$1.50/百万トークン・出力$7.50/百万トークンと低コスト化3.5 Flash Cyberはコードのセキュリティ脆弱性の検出・修正に特化し、政府や信頼パートナー限定の限定アクセスパイロットで提供
DeepMind Official Blogバイオレジリエンスへの私たちのアプローチGoogle DeepMindとIsomorphic Labsが、AIを活用した生物安全保障への共同アプローチを公開したAlphaFold・AlphaGenome・IsoDDEなどを、信頼できるパートナーに提供し、感染症の予防・検知・対応を支援するSynthIDの透かし技術を生物分野に応用し、AIが生成した危険な遺伝子配列のスクリーニングも研究中