ByteDance Seed

AIの最新動向を毎日お届け。要点だけをシンプルに。

→ 注目トピックはこちら

[お知らせ] iOS版をリリースしました🎉

ByteDance Seed

SeedRealtime Audio-Visual Full-Duplex LLMを公開:AIとのより自然な対話を実現する

  • 音声・映像・テキストを単一モデルで統合したリアルタイム対話LLM「SeedRealtime」を正式リリース
  • 従来のモデルと比べ、会話のタイミングのずれを半減し、背景ノイズや無関係な会話による誤反応も抑制する
  • ユーザーが話しかける前に画面の変化を検知して自発的に話しかけることも可能。AIに視覚的な要素が加わり高度な会話が可能になった。
ByteDance Seed

ワンテイク生成、柔軟な参照機能:Seedance 2.5のご紹介

  • ByteDanceがSeedance 2.5を正式リリースし、JimengやDoubao Proなどで提供開始
  • 1回の生成で最大30秒の動画を出力でき、複数回の延長で数分の長尺コンテンツを制作できる
  • 参照素材として画像30枚・動画10本・音声10本を1回で入力でき、タイムスタンプ単位の編集も可能
ByteDance Seed

音声から音楽制作へ | 音楽制作モデル「Seed Audio 1.0」のご紹介

  • ByteDanceがシーン全体の音声を一括生成するAIモデル「Seed Audio 1.0」をBytePlusで公開した
  • セリフ・効果音・環境音を1つのプロンプトから同時生成でき、台詞のタイミング制御は100ms単位で指定できる
  • 20以上の言語に対応し、多シナリオでの使用可能な音声の生成率は大半のシナリオで90%超、音声自然性のMOSスコアは大半の言語で4.0以上を達成
ByteDance Seed

生成を超え、デザインを理解する | Seedream 5.0 Pro のご紹介

  • ByteDanceがAI画像生成モデル「Seedream 5.0 Pro」を正式公開した
  • 複雑な情報の図解化、領域指定編集、多言語対応など4つの核心機能を備え、専門的な制作現場での実用性を高めた
  • 文章指示だけでは難しかった「どこを編集するか」という課題に空間認識で応えており、制作現場での反復作業を減らす可能性がある
ByteDance Seed

EdgeBench:実世界の環境学習を測定し、新たなスケーリング則を発見する

  • 長時間の環境操作でエージェントの学習曲線が対数シグモイド曲線(R²=0.998)に従うことが判明した
  • 訓練済み知識だけでなく、環境との反復的なやり取りを通じて継続的に性能が向上する能力が重要になっている
  • 世代を追うごとに学習速度が約3か月で倍増しており、初期能力だけでなく学習速度がモデル間の差別化要因になりつつある
ByteDance Seed

Seed2.1 正式リリース:AIの生産性を次のレベルへ

  • Seed2.1ファミリーが公開され、エージェント機能・コーディング・マルチモーダル理解の3分野で性能が向上した
  • 実際の業務フローでの完遂能力を重視して設計されており、複数ステップの作業を自律的に実行できる
  • 静的なベンチマーク偏重から実用性重視へと開発方針が移行しており、現場での信頼性が評価軸になっている
ByteDance Seed

Seed-2.1-PreviewモデルのArenaにおけるリリース

  • Seed-2.1-Pro-PreviewをArena AIのCode arenaで公開し、早期アクセスを開始した
  • 今後2週間以内にFeishu SparkとCozeでも利用できるようになる
  • 現時点ではArena AIのみで試せる限定公開の段階にある