Marengo 3.5: Precision & Control for Frontier Video Intelligence
TwelveLabs は、動画・音声・画像・テキスト・ドキュメントを単一の共有セマンティック空間で扱うマルチモーダル埋め込みモデル Marengo 3.5 を公開した。テキストから動画への検索精度は前バージョン比で 6.29 ポイント向上し、複数の入力形式を組み合わせたコンポーザブルなクエリにも対応する。埋め込み次元数の設定、時間軸に沿ったメタデータ統合、ビジュアル PDF への対応が追加され、従来の 4 時間という長さ制限は撤廃された。課金は再生時間ベースからモダリティ別のトークン従量制に変更された。