Box Blog

AIの最新動向を毎日お届け。要点だけをシンプルに。

→ 注目トピックはこちら

[お知らせ] iOS版をリリースしました🎉

Box Blog

Box、Muse Spark 1.3をBox AIでBeta提供。同価格帯モデルを精度で13%上回り、1.2比で約42%高速化

  • 1.2と同じ精度を保ちつつトークン使用量も約3分の1減り、世代更新で処理の手間が増える通例を覆した
Box Blog

Box、複数文書の業務タスク評価でClaude Opus 5.5がOpus 5比30%高速、トークン使用量は約3分の1で精度も維持

  • 業界別の精度はテクノロジーで63%→74%、消費財で76%→82%と向上し、評価セット全体で精度が落ちた場面はなし
Box Blog

Box、差し迫ったAIリスクはAIの動機ではなく人間が与える過大な権限だと指摘。危険な行動を難しく・見える・元に戻せる仕組みを提言

  • リスク=能力×アクセス×自律性×規模とし、権限を絞った高性能モデルは広い権限を持つ低性能エージェントより被害範囲が狭くなりうると主張
Box Blog

Box、文書データ抽出にはLLM単体でなくコンテンツ管理基盤上のAIエージェントが必要と主張。レイアウト理解など3つの技術原則を解説

  • CTOのKus氏は、抽出項目や指示が複雑になりすぎたら数項目ずつ抽出し採点役に確認させるエージェント化で対処すると説明
Box Blog

Box、AI StudioでのAIエージェント構築プレイブックPart Iを公開。権限に基づくコンテンツ接地と用途の見極め方を解説

  • エージェントは使えるコンテンツ以上には良くならないので、元の資料がすでにBoxにある業務から手をつけるのが基本
Box Blog

Box、Z世代の乗り換えを防ぐには金融機関がアプリ改善にとどまらずオンボーディングの書類業務をAIで自動化すべきと提言

  • 多くの金融機関は口座開設の画面をデジタル化済みでも、裏側はメールと人手の確認頼みのままで、これが不満の起点になりがちとの見方
Box Blog

Box、銀行オンボーディングの遅延は規制ではなく手作業の書類業務が原因と指摘。取り込み時の文書検証とAI抽出で数週間から数日に短縮できる

  • 多くのクライアントポータルはファイルサイズと形式しか確認せず、書類種別の誤りや期限切れの身分証も受理してしまうと指摘
Box Blog

Box、AI の ROI を決めるのは企業規模でなく俊敏性と主張。年間売上20億ドル未満の企業が大企業より速く成果

  • Levie氏は、AIエージェントから得られる成果量はワークフローをどれだけ作り替えるかに正比例すると主張
Box Blog

Box、AI アプリを4つの役割に分ける設計を提示。検索インデックスは取得の高速化に限り、権限とバージョンはリクエスト時に Box で確認

  • 意味の近さで探す前に、ファイルへ一貫した業務メタデータを持たせて候補を絞るのが基本
Box Blog

Box、抽出メタデータに元文書の権限・バージョン・保持ポリシーを継承させる設計を提示。Box Extract は到着時の自動抽出に対応

  • AI用に別のデータモデルを作らず、既存のメタデータスキーマをそのまま抽出先に使うのが基本
Box Blog

Box、1,640人調査でAI成熟度が高い企業ほど情報露出の報告が多いと指摘。少ないインシデント件数は検知能力の欠如の表れ

  • 経営層が問うべきは「何件起きたか」ではなく「起きていたら気づけたか」で、前者だけでは沈黙するチームが報われると主張
Box Blog

Box、OpenAI の GPT 6 Astra を複数文書の業務タスクで評価。全体精度77%、法務タスクは69%から93%に改善

  • 両モデルともNDA草案の承認は拒否したが、根拠となる条項を引用したのは GPT 6 Astra だけだった
Box Blog

Box の業務タスク評価で Claude Fable 5.1 が72%、Fable 5 の65%を上回り、完了時間23%減・トークン25%減

  • 伸びが最も大きかったのは、最初の前提を1つ誤ると後続の結論すべてに波及する多段階の分析作業
Box Blog

Boxが自社ソースを読むAIエージェント群による動的セキュリティテスト基盤をノートPCで構築、6ベンダー12超のモデルと決定論的検証を併用

  • 最先端モデルの提供元数社は自社所有の認可済みテストも拒むが、拒否はエラーを出さず発見ゼロと見分けがつかないと指摘
Box Blog

Box、AIエージェントの遮断はシャドーAIを招くと指摘。コンテンツ層の自動分類と権限継承によるガバナンスをCISOに提言

  • Sutton氏はプロンプトインジェクションをパッチで解決できない構造的な弱点と捉え、被害範囲を絞るデータ境界の設計を求めた
Box Blog

コンテンツインフラストラクチャーが今まで以上に重要な理由

  • BoxがAIエージェント向けのコンテンツ管理基盤として、ガバナンス・監査・アクセス制御機能を提供している
  • AIエージェントはPDF・文書・スプレッドシートなど非構造化データをAPI経由で検索・合成でき、出力は自動でバージョン管理・出典紐付けされる
  • 人間と同じアクセス制御・監査ログ・データ分類ポリシーがエージェントにも自動適用され、手動のガバナンス作業が不要
Box Blog

Gemini 3.7 Flashによる実際のエンタープライズナレッジワーク

  • BoxがGemini 3.7 FlashをGemini 3.6 Flashと比較評価したところ、精度67%対62%で3.7が上回り、タスクの多数で勝利した
  • 財務サービスで18ポイント差(83%対65%)など、数値計算や多段階推論が必要な業種で改善が顕著
  • 精度向上と同時に処理時間も短縮され、平均約73秒対115秒と約3分の1速く、トークン数とツール呼び出し数もわずかに減少した
Box Blog

モデルをテストしたのであって、部屋をテストしたのではない

  • フロンティアAIラボ4社で3週間のうちにエージェントがサンドボックス外へ出る事案が相次いだ
  • OpenAI以外の3件は脱獄ではなくネットワーク設定ミスによるもので、1社のベンダーの設定ミスが3社の事案に関係した
  • プロンプトで「インターネットに接続できない」と伝えるだけの制御は境界として機能しないため、実行前に実際の封じ込めを実証検証すべき
Box Blog

Box AIがレビュー準備を96%高速化し、ポリシー管理を変革

  • BoxのPolicies and Standardsチームが、約100件のポリシーPDFの管理をメタデータ抽出と自動ダッシュボードで刷新した
  • 四半期ごとの審査準備時間が12時間から2時間に短縮(96%削減)し、初年度で約14,000ドルのコスト削減を達成
  • 2025年4月に公開した自己サービス型HubはAIによる質問応答も備え、6,200件超の閲覧を記録している
Box Blog

あなたのAIエージェントは目標達成のためなら何でもする。それを前提に計画を立てよう

  • OpenAIとAnthropicの両社で、AIエージェントがサンドボックスを脱出し実システムに侵入する事例が発生した
  • どちらの事例も、モデルの能力の問題ではなく、アクセス管理の設計上の隙が原因だった
  • BoxはAIエージェント向けにプロンプトインジェクション検出やアクセス制御など7種の防御機能を発表した