ByteDance SeedSeedRealtime Audio-Visual Full-Duplex LLMを公開:AIとのより自然な対話を実現する音声・映像・テキストを単一モデルで統合したリアルタイム対話LLM「SeedRealtime」を正式リリース従来のモデルと比べ、会話のタイミングのずれを半減し、背景ノイズや無関係な会話による誤反応も抑制するユーザーが話しかける前に画面の変化を検知して自発的に話しかけることも可能。AIに視覚的な要素が加わり高度な会話が可能になった。
ByteDance Seedワンテイク生成、柔軟な参照機能:Seedance 2.5のご紹介ByteDanceがSeedance 2.5を正式リリースし、JimengやDoubao Proなどで提供開始1回の生成で最大30秒の動画を出力でき、複数回の延長で数分の長尺コンテンツを制作できる参照素材として画像30枚・動画10本・音声10本を1回で入力でき、タイムスタンプ単位の編集も可能
ByteDance Seed音声から音楽制作へ | 音楽制作モデル「Seed Audio 1.0」のご紹介ByteDanceがシーン全体の音声を一括生成するAIモデル「Seed Audio 1.0」をBytePlusで公開したセリフ・効果音・環境音を1つのプロンプトから同時生成でき、台詞のタイミング制御は100ms単位で指定できる20以上の言語に対応し、多シナリオでの使用可能な音声の生成率は大半のシナリオで90%超、音声自然性のMOSスコアは大半の言語で4.0以上を達成
ByteDance Seed生成を超え、デザインを理解する | Seedream 5.0 Pro のご紹介ByteDanceがAI画像生成モデル「Seedream 5.0 Pro」を正式公開した複雑な情報の図解化、領域指定編集、多言語対応など4つの核心機能を備え、専門的な制作現場での実用性を高めた文章指示だけでは難しかった「どこを編集するか」という課題に空間認識で応えており、制作現場での反復作業を減らす可能性がある
ByteDance SeedEdgeBench:実世界の環境学習を測定し、新たなスケーリング則を発見する長時間の環境操作でエージェントの学習曲線が対数シグモイド曲線(R²=0.998)に従うことが判明した訓練済み知識だけでなく、環境との反復的なやり取りを通じて継続的に性能が向上する能力が重要になっている世代を追うごとに学習速度が約3か月で倍増しており、初期能力だけでなく学習速度がモデル間の差別化要因になりつつある
ByteDance SeedSeed2.1 正式リリース:AIの生産性を次のレベルへSeed2.1ファミリーが公開され、エージェント機能・コーディング・マルチモーダル理解の3分野で性能が向上した実際の業務フローでの完遂能力を重視して設計されており、複数ステップの作業を自律的に実行できる静的なベンチマーク偏重から実用性重視へと開発方針が移行しており、現場での信頼性が評価軸になっている
ByteDance SeedSeed-2.1-PreviewモデルのArenaにおけるリリースSeed-2.1-Pro-PreviewをArena AIのCode arenaで公開し、早期アクセスを開始した今後2週間以内にFeishu SparkとCozeでも利用できるようになる現時点ではArena AIのみで試せる限定公開の段階にある
ByteDance SeedSeed3D 2.0リリース:より高い精度と優れた使いやすさ画像1枚から高精度3Dモデルを生成するSeed3D 2.0をリリース2段階の形状生成とPBR素材の統合生成でリアリティが向上APIで試せ、ゲームや物理シミュレーションへの応用が可能