
何が起きたか
turbopufferがv3を発表。ANNアドレスを基点とする設計をやめ、ANNベクトル索引を二次索引の一つに位置づけるストレージ構成の変更で、今月初旬にCIを100%通過した。
なぜ重要か
同社によれば、あらゆるクエリプランで大幅な性能向上が可能になり、ストレージ増幅・書き込み増幅・ベクトル化の制約という3つの課題も解消するという。
注目点
ベンチマークは未公開で、数週間以内に公開するとしている。本番展開の前に性能同等化を目指すとしており、その数値が焦点となる。
誰に効くかturbopuffer上で大規模な検索・検索システムを運用するチームは、新アーキテクチャの展開に伴いベクトル以外のクエリが高速化する可能性がある。ただし同社は性能同等化に達するまで本番環境には移行しないとしている。
こういう要約が、毎朝あなたのメールに届きます。
turbopufferの当初の設計v1は、文書ごとにIDとベクトルだけを保存し、クラスタIDとローカルIDを組み合わせたANNアドレスをキーとしていた。このレイアウトはオブジェクトストレージ上のベクトル検索に適し、CursorやNotionといった初期顧客がそのトレードオフを裏付けた。その後v2で属性フィルタリングと全文検索を追加し、Linearなどの顧客は同期エンジンといった検索以外の用途にも使い始めた。しかし文書内のすべてがANNアドレスの下に保存されるため、ストレージ増幅、書き込み増幅、ベクトル化の制約という3つの課題に直面したと同社は言う。約100〜200文書というANNクラスタサイズが、あらゆるクエリプランのブロックサイズの上限となっていた。ANNを単なる二次索引の一つにすることで、turbopufferはこの上限を取り払い、すべてのクエリプランを高速化したい考えだ。成否は、既存顧客が依存するベクトル検索性能を落とさずに性能同等化を達成できるかどうかにかかっている。
業界と使っているAIツールを選ぶと、仕事に関係するニュースが毎朝届きます。
登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。
富士通が店舗運営と経営判断を支援する4種類のAIエージェントを発表し、同日から試験提供を開始

中国製物流ロボットが日本で普及し、トヨタやコマツなどが採用

ACSHUがソフトバンクの「AGENTIC STAR インテグレーションパートナー アライアンス」に参画し、企業導入を計画段階から運用まで支援する

三菱重工とAlgomatic Dynamicsは、熟練者と訓練生の映像を比較し滞留時間や軌道の違いを指摘するTIG溶接向けAI動画解析ツールを開発

富士通が、店舗運営と経営判断の高度化を狙う小売業向けAIエージェントの試用環境の提供を開始した

三菱商事系企業が大阪にデータセンターを開設した
