検索は人間のために作られました。1 つのクエリを入力し、結果をスキャンし、絞り込み、再試行する。その繰り返しです。
30 年にわたるインフラは、そのループを中心に設計されています。
AI エージェントはそうではありません。エージェントは一度に多くの角度から質問を投げかけ、全てをまとめて取得したいのです。
しかし、現在のエージェントに供給されている検索 API は、人間向けのループをエンドポイントで包んだだけのものです。
1 つのクエリを入力し、1 つの応答が返ってくる。それに数百ミリ秒かかります。
私たちは昨年、実際に検索を行うもののために検索を再構築してきました。それについてあまり公表していませんでした。
正直なところ、準備ができていませんでした。今年の初めには、自分たちの期待値の 70% 程度にしか達していないと感じていました。70% で騒ぎたくなかったのです。
今、準備は整いました。
数字
Octen の Web 検索 API は、SealQA Hard で測定した結果、62ms (P50) で結果を返し、P90 は 68ms です。
これは Exa、Parallel、および類似のサービスよりも数倍高速です。
最速の代替サービスでも約 244ms です。最も遅いものは 2.6 秒以上かかります。

このグラフで見出し以上に重要な細部があります。それは、私たちの P50 と P90 の差が 6ms であることです。一部のサービスでは 1 秒以上です。
エージェントが検索にかかる時間を予測できないと、それに合わせた計画が立てられません。
価格は 1,000 コールあたり $1 です。このカテゴリのほとんどのサービスは $4 から $9 を請求します。
品質について:Octen Embedding は RTEB で 1 位、VL 埋め込みモデルは MMEB-v2 で 1 位です。
テキスト埋め込みモデルをオープンソース化したところ、5 か月で 50 万回以上ダウンロードされました。
DeepResearch Bench では、OpenAI Deep Research、Gemini、Grok よりも 10 から 17 ポイント高いスコアを獲得しています。
FreshQA Strict と SimpleQA では、テストしたすべてのベンダーをリードしています。

注:すべてのベンチマークは公開されており、再現可能です。末尾にリンクがあります。
なぜ始めたのか
私の名前は Kuan Zou です。Octen の前は、Alibaba Cloud で 5 年間 AI 検索のプロダクトリードを務め、数億人のユーザーにサービスを提供するシステムを運用していました。
その前は、Baidu のエンタープライズ検索プラットフォームをゼロから構築しました。
Alibaba では毎年、ブラックフライデーを乗り切るのが私の仕事でした。1 日に数十億のクエリが発生し、失敗は許されませんでした。
そのため、AI エージェントに提供されている検索 API を見たとき、私は本当に驚きました。ほとんどのものは、1 秒あたりのクエリ数が数十に達すると壊れ始めます。
実際の作業を行うエージェントは、20、50、100 の検索を同時にトリガーします。エージェントが最も依存するインフラストラクチャが、最初に故障する部分です。
私たちは Square Peg がリードした $10M のシードラウンド を調達し、Alibaba、Baidu、Meta、Google、TikTok、DeepSeek、Xiaohongshu からチームを結集し、作業に取り掛かりました。
線形から並列へ
Octen に質問を与えると、それを数十のサブクエリに分解し、すべてを同時に発射し、返ってきたすべてを一つの答えにまとめます。
1 つずつではありません。すべてを一度にです。



これがディープリサーチで行うことです:3 分以内に完全なソース付きレポートを作成します。同じタスクに 1 時間以上かかるシステムは、DeepResearch Bench で私たちのスコアを下回ります。

62ms では、検索は外部ツールのように振る舞うのをやめ、メモリのように振る舞い始めます。
エージェントは、自身のコンテキストを推論する速度に近い速度で、ライブ Web を推論します。
これにより、以前は実用的ではなかったアプリケーションが可能になります。リアルタイム取引エージェント、ライブスポーツや市場データ、不自然な間なしに応答する音声エージェントなどです。

信頼性のために構築
1 つの Octen アカウントで 1 秒あたり 100 万以上のクエリをサポートします。新しいコンテンツは公開後 5 分以内にインデックス化されます。
また、SLA 付きの保証 QPS も提供しています。
私の知る限り、このカテゴリでこれを約束できるのは私たちだけです。なぜなら、インデックスをエンドツーエンドで所有している場合にのみ可能だからです。私たちはそれを所有しています。

テキスト以外にも、画像検索と動画検索を実行し、ライブ Web からの実際の参照を使用して画像と動画生成をグラウンディングします。
このレイヤーは現在早期アクセス中です。

5倍安い理由
トリックはありません。
ほとんどの「AI 向け検索」製品は、人間向けに設計されたオープンソースの検索スタック上に構築されています。クエリボックスの背後にあるエンジンをそのまま API の背後に移しただけです。
テクノロジーは変わっていません。インターフェースだけが変わったのです。それを「AI 向け検索」と呼ぶのは意味がありません。
私たちはすべてを再構築しました。検索エンジン、ランキング、サーバーレイヤー、すべてを機械向けにゼロから書き直しました。私たちのスタックには、結果をスクロールする人間のために設計されたものは何もありません。
だからこそ、その価格が可能なのです。完全に AI ネイティブなエンジンは、30 年にわたる人間向け検索のオーバーヘッドを引き継いでいません。1,000 コールあたり $1 でもビジネスは健全です。これは期限切れを待つ補助金ではありません。
価格はアーキテクチャの最も正直な証明です。誰でも検索が AI 向けに構築されていると主張できます。コスト構造がその真偽を示します。
このカテゴリの一部の企業は、すでに毎日私たちの API を自社のものと比較して実行しています。
それは褒め言葉だと受け取っています。
なぜすべてを公開するのか
私たちが何をしているかを知ることと、それを構築できることは別の問題です。
私たちの強みは、世界で最も困難な検索トラフィックを 10 年にわたって処理してきたチームです。
先駆者たちが市場を教育してくれたことに感謝しています。
しかし、開発者は常に数字を確認し、最もパフォーマンスが良く、コストが最も低いものにルーティングします。
それが世界で最も正直な市場だと思います。
既存企業はこの 2 年間をマーケティングに費やしました。私たちはエンジニアリングに費やしました。
今、そのエンジニアリングは公開されています。
物理的な時代
次世代の AI はスクリーン上に存在しません。
メガネ、ロボティクス、ワールドモデル。その世界では、検索が目となります:ライブ Web のリアルタイム認識です。
ロボットは答えを 3 秒待つことはできません。
検索が数十ミリ秒で返されるようになると、物理的な AI のリアルタイムインタラクションが、これまで阻んでいたボトルネックをようやく突破します。
その時代には、100ms を超えるレイテンシーは生き残れないと私は考えています。今日、私たちはその基準を下回る唯一の存在です。
エージェントスタックは、基盤モデル、GPU、ライブ検索の 3 つの部分に収束しつつあります。
最初の 2 つは明確な勝者がいる解決済みの問題です。3 つ目はまだ決着がついていません。それが私たちが勝ちたいレースです。
自分で試す
ベンチマークは公開されており、API はオープンです。
1,000 コールあたり $1、$5 の無料クレジット付き。API、Skills、MCP、CLI から利用可能です。Claude Code、Cursor、VS Code、および任意の MCP クライアントで動作します。
現在使用しているものと比較してみてください。
同じクエリを並べて実行し、結果を投稿してください。
このカテゴリの企業はすでに毎日私たちをベンチマークしており、あなたもそうすべきです。
ドキュメント: docs.octen.ai
注:レイテンシーと精度の数値は、SealQA Hard、FreshQA Strict、SimpleQA で測定されました。テスト日時と地域は各グラフに記載されています。ベンチマークの再現: https://github.com/Octen-Team/search-eval





