Мы работали молча и создали САМЫЙ БЫСТРЫЙ поиск на планете

@KZouAPT
АНГЛИЙСКИЙ7 часов назад · 21 июл. 2026 г.
399K
351
82
146
138

Суть

Octen представляет AI-native API поиска, разработанный для высоконагруженных агентов, с задержкой 62 мс и прорывной ценой в $1 за 1000 запросов. Созданный экспертами в области поиска, он призван заменить традиционные поисковые стеки, ориентированные на человека.

Поиск создавался для людей. Вы вводите один запрос, просматриваете результаты, уточняете и пробуете снова.

Тридцать лет инфраструктуры завязаны на этом цикле.

AI-агенты работают НЕ так. Агент хочет задать вопрос с разных сторон одновременно и получить всё сразу.

Но поисковые API, которые сегодня питают агентов, — это тот же человеческий цикл, обёрнутый в эндпоинт.

Один запрос — один ответ, сотни миллисекунд каждый.

Последний год мы потратили на то, чтобы перестроить поиск под того, кто реально ищет. Мы мало об этом писали.

Честно говоря, мы не были готовы. В начале года я чувствовал, что мы на 70% от собственных ожиданий, и не хотел шуметь о 70%.

Теперь мы готовы.

Цифры

Веб-поисковый API Octen возвращает результаты за 62 мс (P50) с P90 68 мс, измерено на SealQA Hard.

Это в несколько раз быстрее Exa, Parallel и аналогичных сервисов.

Самый быстрый альтернативный вариант — около 244 мс. Самый медленный — более 2,6 секунд.

Kuan Zou - inline image

Одна деталь на этом графике важнее заголовка: разрыв между нашим P50 и P90 составляет 6 мс. У некоторых сервисов он превышает секунду.

Если ваш агент не может предсказать, сколько времени займёт поиск, он не может планировать на его основе.

Цена — 1 доллар за 1000 вызовов. Большинство сервисов в этой категории берут от 4 до 9 долларов.

По качеству: Octen Embedding занимает 1-е место в RTEB, а наша VL-модель эмбеддингов — 1-е место в MMEB-v2.

Мы опубликовали модели текстовых эмбеддингов в открытом доступе, и за пять месяцев их скачали более 500 000 раз.

На DeepResearch Bench мы опережаем OpenAI Deep Research, Gemini и Grok на 10–17 баллов.

На FreshQA Strict и SimpleQA мы лидируем среди всех вендоров, с которыми тестировались.

Kuan Zou - inline image

Примечание: Все бенчмарки опубликованы и воспроизводимы. Ссылки в конце.

Почему я это начал

Меня зовут Куан Цзоу. До Octen я пять лет руководил направлением AI-поиска в Alibaba Cloud, управляя системами, обслуживающими сотни миллионов пользователей.

До этого я с нуля построил корпоративную поисковую платформу Baidu.

Каждый год в Alibaba моей задачей было пережить «Чёрную пятницу». Миллиарды запросов в день — и никакой терпимости к сбоям.

Поэтому, когда я посмотрел на поисковые API, которые дают AI-агентам, я был искренне удивлён. Большинство из них начинают ломаться, когда количество запросов в секунду достигает десятков.

Агент, выполняющий реальную работу, может запустить 20, 50, 100 поисков одновременно. Инфраструктура, от которой агенты зависят больше всего, — это та часть, которая отказывает первой.

Мы привлекли $10 млн Seed-раунда под руководством Square Peg, собрали команду из Alibaba, Baidu, Meta, Google, TikTok, DeepSeek и Xiaohongshu и приступили к работе.

От линейного к параллельному

Задайте Octen вопрос — и он разбивает его на десятки подзапросов, запускает их все одновременно и собирает всё, что пришло, в один ответ.

Не один запрос за раз, а все сразу.

Kuan Zou - inline image
Kuan Zou - inline image
Kuan Zou - inline image

Вот как это работает в глубоком исследовании: полноценный отчёт с источниками менее чем за 3 минуты. Системы, тратящие на ту же задачу больше часа, показывают результаты ниже нас на DeepResearch Bench.

Kuan Zou - inline image

При 62 мс поиск перестаёт вести себя как внешний инструмент и начинает вести себя как память.

Ваш агент рассуждает о живом вебе почти с той же скоростью, с какой рассуждает о своём собственном контексте.

Это открывает приложения, которые раньше были непрактичны. Торговые агенты в реальном времени. Данные о спорте и рынках в прямом эфире. Голосовые агенты, отвечающие без неловкой паузы.

Kuan Zou - inline image

Создано для надёжности

Один аккаунт Octen поддерживает более 1 000 000 запросов в секунду. Новый контент индексируется в течение 5 минут после публикации.

Мы также предлагаем гарантированный QPS с SLA.

Насколько мне известно, мы единственные в этой категории, кто может это обещать, потому что это возможно только тогда, когда вы владеете индексом от начала до конца. У нас так и есть.

Kuan Zou - inline image

Помимо текста, мы запускаем поиск изображений и видео, а также подкрепляем генерацию изображений и видео реальными ссылками из живого веба.

Этот слой сейчас в раннем доступе.

Kuan Zou - inline image

Почему это ещё и в 5 раз дешевле

Никакого трюка.

Большинство «поиска для AI» продуктов построено на поисковых стеках с открытым исходным кодом, которые создавались для людей. Они взяли движок, стоящий за строкой запроса, и поместили его за API.

Технология не изменилась. Изменился только интерфейс. Называть это «поиском для AI» бессмысленно.

Мы перестроили всё. Поисковый движок, ранжирование, сервисный слой — всё написано с нуля для машинного потребления. Ничего в нашем стеке не проектировалось для человека, прокручивающего результаты.

Вот почему возможна такая цена. Полностью AI-нативный движок не наследует тридцать лет накладных расходов человеческого поиска. Бизнес здоров при цене 1 доллар за 1000 вызовов. Это не субсидия, которая скоро закончится.

Цена — самое честное доказательство архитектуры. Кто угодно может заявить, что его поиск создан для AI. Структура затрат показывает, правда ли это.

Некоторые компании в этой категории уже ежедневно прогоняют наш API против своего.

Я воспринимаю это как комплимент.

Почему я делюсь всем

Знать, что мы делаем, и уметь это построить — разные задачи.

Наша защита — команда, которая провела десятилетие, обрабатывая одни из самых сложных поисковых нагрузок в мире.

Первые игроки обучили рынок, и я благодарен им за это.

Но разработчики всегда проверяют цифры и направляют трафик туда, где лучшая производительность и наименьшая цена.

Я думаю, это самый честный рынок в мире.

Действующие игроки потратили последние два года на маркетинг. Мы потратили их на инженерию.

Теперь инженерия стала публичной.

Физическая эра

Следующее поколение AI не живёт на экране.

Очки, робототехника, мировые модели. В этом мире поиск становится глазами: восприятие живого веба в реальном времени.

Робот не может ждать 3 секунды ответа.

Когда поиск возвращается за десятки миллисекунд, взаимодействие в реальном времени для физического AI наконец прорывает узкое место, которое его сдерживало.

В эту эру я не верю, что что-либо с задержкой выше 100 мс выживет. Сегодня мы единственные, кто находится ниже этой планки.

Стек агентов делится на три части: фундаментальные модели, GPU и живой поиск.

Первые две — решённые задачи с явными победителями. Третья всё ещё решается. Это гонка, которую мы намерены выиграть.

Попробуйте сами

Бенчмарки открыты, API доступен.

1 доллар за 1000 вызовов, 5 долларов бесплатного кредита. Доступен как API, как Skills, через MCP и из CLI. Работает в Claude Code, Cursor, VS Code и любом MCP-клиенте.

Проверьте нас против того, что вы используете сегодня.

Те же запросы, бок о бок. Опубликуйте, что найдёте.

Компании в этой категории уже тестируют нас ежедневно, и вам тоже стоит.

Документация: docs.octen.ai

Примечание: Показатели задержки и точности измерены на SealQA Hard, FreshQA Strict и SimpleQA. Дата и регион теста указаны на каждом графике. Воспроизведите бенчмарк: https://github.com/Octen-Team/search-eval

Переделать в YouMind

Превратите одну вирусную статью в полноценный рабочий процесс создания контента

Собирайте источники, расшифровывайте паттерны, создавайте активы, пишите черновики и публикуйте контент из одного рабочего пространства ИИ.

Исследовать YouMind
Для авторов

Превратите ваш Markdown в аккуратную статью для 𝕏

Когда вы публикуете длинные тексты, изображения, таблицы и блоки кода, форматирование в 𝕏 становится мучением. YouMind превращает полный черновик в Markdown в чистую статью, готовую к публикации в 𝕏.

Попробовать Markdown для 𝕏

Другие паттерны для анализа

Недавние виральные статьи

Смотреть другие виральные статьи