Поиск создавался для людей. Вы вводите один запрос, просматриваете результаты, уточняете и пробуете снова.
Тридцать лет инфраструктуры завязаны на этом цикле.
AI-агенты работают НЕ так. Агент хочет задать вопрос с разных сторон одновременно и получить всё сразу.
Но поисковые API, которые сегодня питают агентов, — это тот же человеческий цикл, обёрнутый в эндпоинт.
Один запрос — один ответ, сотни миллисекунд каждый.
Последний год мы потратили на то, чтобы перестроить поиск под того, кто реально ищет. Мы мало об этом писали.
Честно говоря, мы не были готовы. В начале года я чувствовал, что мы на 70% от собственных ожиданий, и не хотел шуметь о 70%.
Теперь мы готовы.
Цифры
Веб-поисковый API Octen возвращает результаты за 62 мс (P50) с P90 68 мс, измерено на SealQA Hard.
Это в несколько раз быстрее Exa, Parallel и аналогичных сервисов.
Самый быстрый альтернативный вариант — около 244 мс. Самый медленный — более 2,6 секунд.

Одна деталь на этом графике важнее заголовка: разрыв между нашим P50 и P90 составляет 6 мс. У некоторых сервисов он превышает секунду.
Если ваш агент не может предсказать, сколько времени займёт поиск, он не может планировать на его основе.
Цена — 1 доллар за 1000 вызовов. Большинство сервисов в этой категории берут от 4 до 9 долларов.
По качеству: Octen Embedding занимает 1-е место в RTEB, а наша VL-модель эмбеддингов — 1-е место в MMEB-v2.
Мы опубликовали модели текстовых эмбеддингов в открытом доступе, и за пять месяцев их скачали более 500 000 раз.
На DeepResearch Bench мы опережаем OpenAI Deep Research, Gemini и Grok на 10–17 баллов.
На FreshQA Strict и SimpleQA мы лидируем среди всех вендоров, с которыми тестировались.

Примечание: Все бенчмарки опубликованы и воспроизводимы. Ссылки в конце.
Почему я это начал
Меня зовут Куан Цзоу. До Octen я пять лет руководил направлением AI-поиска в Alibaba Cloud, управляя системами, обслуживающими сотни миллионов пользователей.
До этого я с нуля построил корпоративную поисковую платформу Baidu.
Каждый год в Alibaba моей задачей было пережить «Чёрную пятницу». Миллиарды запросов в день — и никакой терпимости к сбоям.
Поэтому, когда я посмотрел на поисковые API, которые дают AI-агентам, я был искренне удивлён. Большинство из них начинают ломаться, когда количество запросов в секунду достигает десятков.
Агент, выполняющий реальную работу, может запустить 20, 50, 100 поисков одновременно. Инфраструктура, от которой агенты зависят больше всего, — это та часть, которая отказывает первой.
Мы привлекли $10 млн Seed-раунда под руководством Square Peg, собрали команду из Alibaba, Baidu, Meta, Google, TikTok, DeepSeek и Xiaohongshu и приступили к работе.
От линейного к параллельному
Задайте Octen вопрос — и он разбивает его на десятки подзапросов, запускает их все одновременно и собирает всё, что пришло, в один ответ.
Не один запрос за раз, а все сразу.



Вот как это работает в глубоком исследовании: полноценный отчёт с источниками менее чем за 3 минуты. Системы, тратящие на ту же задачу больше часа, показывают результаты ниже нас на DeepResearch Bench.

При 62 мс поиск перестаёт вести себя как внешний инструмент и начинает вести себя как память.
Ваш агент рассуждает о живом вебе почти с той же скоростью, с какой рассуждает о своём собственном контексте.
Это открывает приложения, которые раньше были непрактичны. Торговые агенты в реальном времени. Данные о спорте и рынках в прямом эфире. Голосовые агенты, отвечающие без неловкой паузы.

Создано для надёжности
Один аккаунт Octen поддерживает более 1 000 000 запросов в секунду. Новый контент индексируется в течение 5 минут после публикации.
Мы также предлагаем гарантированный QPS с SLA.
Насколько мне известно, мы единственные в этой категории, кто может это обещать, потому что это возможно только тогда, когда вы владеете индексом от начала до конца. У нас так и есть.

Помимо текста, мы запускаем поиск изображений и видео, а также подкрепляем генерацию изображений и видео реальными ссылками из живого веба.
Этот слой сейчас в раннем доступе.

Почему это ещё и в 5 раз дешевле
Никакого трюка.
Большинство «поиска для AI» продуктов построено на поисковых стеках с открытым исходным кодом, которые создавались для людей. Они взяли движок, стоящий за строкой запроса, и поместили его за API.
Технология не изменилась. Изменился только интерфейс. Называть это «поиском для AI» бессмысленно.
Мы перестроили всё. Поисковый движок, ранжирование, сервисный слой — всё написано с нуля для машинного потребления. Ничего в нашем стеке не проектировалось для человека, прокручивающего результаты.
Вот почему возможна такая цена. Полностью AI-нативный движок не наследует тридцать лет накладных расходов человеческого поиска. Бизнес здоров при цене 1 доллар за 1000 вызовов. Это не субсидия, которая скоро закончится.
Цена — самое честное доказательство архитектуры. Кто угодно может заявить, что его поиск создан для AI. Структура затрат показывает, правда ли это.
Некоторые компании в этой категории уже ежедневно прогоняют наш API против своего.
Я воспринимаю это как комплимент.
Почему я делюсь всем
Знать, что мы делаем, и уметь это построить — разные задачи.
Наша защита — команда, которая провела десятилетие, обрабатывая одни из самых сложных поисковых нагрузок в мире.
Первые игроки обучили рынок, и я благодарен им за это.
Но разработчики всегда проверяют цифры и направляют трафик туда, где лучшая производительность и наименьшая цена.
Я думаю, это самый честный рынок в мире.
Действующие игроки потратили последние два года на маркетинг. Мы потратили их на инженерию.
Теперь инженерия стала публичной.
Физическая эра
Следующее поколение AI не живёт на экране.
Очки, робототехника, мировые модели. В этом мире поиск становится глазами: восприятие живого веба в реальном времени.
Робот не может ждать 3 секунды ответа.
Когда поиск возвращается за десятки миллисекунд, взаимодействие в реальном времени для физического AI наконец прорывает узкое место, которое его сдерживало.
В эту эру я не верю, что что-либо с задержкой выше 100 мс выживет. Сегодня мы единственные, кто находится ниже этой планки.
Стек агентов делится на три части: фундаментальные модели, GPU и живой поиск.
Первые две — решённые задачи с явными победителями. Третья всё ещё решается. Это гонка, которую мы намерены выиграть.
Попробуйте сами
Бенчмарки открыты, API доступен.
1 доллар за 1000 вызовов, 5 долларов бесплатного кредита. Доступен как API, как Skills, через MCP и из CLI. Работает в Claude Code, Cursor, VS Code и любом MCP-клиенте.
Проверьте нас против того, что вы используете сегодня.
Те же запросы, бок о бок. Опубликуйте, что найдёте.
Компании в этой категории уже тестируют нас ежедневно, и вам тоже стоит.
Документация: docs.octen.ai
Примечание: Показатели задержки и точности измерены на SealQA Hard, FreshQA Strict и SimpleQA. Дата и регион теста указаны на каждом графике. Воспроизведите бенчмарк: https://github.com/Octen-Team/search-eval




![[Извинения и благодарность] Переосмысление ценности офиса в эпоху ИИ](https://youmind.club/__ym/cms-assets/media/1784654487214_c56a6p_HNr6-znbwAAQJbv.jpg)
