AI開発者のための高性能ベクターデータベースとエージェントメモリエンジン
ロスタムは、Rostamlabsのもので、AIアシスタントとエージェントワークフローのための永続メモリを提供するベクターデータベースおよびキー・バリューエンジンです。ストレージとモデルコンテキストをModel Context Protocolエンドポイントを通じて接続し、埋め込み可能なライブラリ、スタンドアロンサーバー、またはクラスターサービスとしての柔軟な展開をサポートします。このツールは、エージェントの状態と検索のためのローカルで高スループットのストアが必要な、リトリーバル拡張生成システムを構築しているAI開発者を対象としています。
Rostamを実際にどのようなタスクに使用できますか?
Rostamは、ベクトルインデックスホストおよび取得ワークフローのためのプログラム可能なデータプレーンとして機能し、エンジニアが付属の「RAG-in-a-box」ツールを使用してドキュメントのチャンク化とインデックス作成を自動化できるようにします。サーバーサイドの拡張ポイントを公開しており、特にWASMストアドプロシージャやカスタムGo関数があり、アプリケーションロジックがデータの隣で実行されることができます。インデックス作成オプションには、HNSW、IVF、Vamanaが含まれ、異なるレイテンシ/リコールのトレードオフをターゲットにしています。
取得の信頼性と速度はどのくらいですか?
エンジンは、サブマイクロ秒のルックアップ特性を持つ専用のキー-バリューパスと、最近傍クエリを加速するための複数のインデックスタイプを提供します。検索は、密なベクトル信号とスパース表現、BM25テキストマッチングを組み合わせて、テキスト重視のコレクションでのリコールを向上させることができます。LLMレスポンスキャッシングプロキシは、繰り返しのチャット完了をローカルに保存し、同一のプロンプトに対する繰り返しの往復を減らし、繰り返しのワークロードに対する応答時間を改善します。
どのようなデプロイメントと入力が必要ですか?
コアはGoで書かれており、デスクトップおよびサーバープラットフォームで実行されます。ライブラリをGoバイナリに埋め込むオプション、単一サーバーインスタンスを実行するオプション、または可用性のためにRaftクラスター全体で状態を複製するオプションがあります。WASMおよびGoベースのサーバーサイドコードをサポートし、MCP互換のクライアントおよびエージェントUIと統合されているため、既存のエージェントチェーンに接続でき、置き換えることはありません。
外部サービスは必要ですか、データはどのように処理されますか?
基本的なテキスト検索は外部APIなしで動作しますが、密なベクトル検索は、よりリッチなベクトルのためにOpenAI互換の埋め込みエンドポイントを接続することでアップグレード可能です。llm-proxyは完了をローカルにキャッシュし、ローカルデプロイメントはコアデータベース機能のための必須のクラウドアカウントを必要としません。MCPクライアントとの互換性により、永続的なエージェント状態は、チームが保持とストレージの場所を制御できる場所にホストできます。
ロスタムを採用すべき人とその時期
ロスタムは、Goベースのデータエンジンを操作し拡張できるエンジニアリングチームに適しており、エージェントのメモリと取得パフォーマンスに対するローカルコントロールを望んでいます。ローカルに展開された場合、外部ベクトルサービスへの依存を減らしますが、管理されたターンキーのホスティングや埋め込みエンドポイントに接続せずに組み込みの密な埋め込みが必要なチームは、ホスティングされた代替案を好むかもしれません。取得のレイテンシーとカスタムサーバーサイドロジックに対する厳密なコントロールが必要な場合に評価してください。





