Разработка ИИ-агентов на базе RAG часто сталкивается с проблемой «галлюцинаций в цикле»: агент бесконечно ищет уточняющую информацию, сжигая токены и бюджет. Концепция Search Budget позволяет жестко контролировать процесс извлечения данных, сохраняя точность ответов без лишних затрат.
#Почему агенты попадают в бесконечный цикл поиска?
В традиционных RAG-системах поиск выполняется один раз. В Agentic RAG агент сам решает, достаточно ли ему информации. Если API выдает нерелевантные или «шумные» данные, агент инициирует новую итерацию поиска. Без четких границ этот процесс превращается в бесконечную воронку расходов.

#Что такое Search Budget и как его внедрить
Search Budget — это ограничение на количество поисковых вызовов или общий объем токенов, выделенных на одну задачу. Вместо того чтобы позволять агенту «гуглить до победного», вы устанавливаете лимиты.
- Лимит итераций: максимум 3-5 поисковых запросов на одну задачу.
- Лимит токенов контекста: отсечение слишком длинных результатов.
- Проверка релевантности: если после второго поиска точность не растет, агент должен вернуть лучший из имеющихся ответов.
#Как срезAI помогает экономить бюджет поиска
Главная причина зацикливания — некачественные данные. Когда headless-браузер обрабатывает динамический контент некорректно, агент получает «пустые» страницы и пробует снова. Мы решаем это за счет полноценного рендеринга на нашей стороне.
| Параметр | Обычный Scraping | срезAI API |
|---|---|---|
| Качество данных | Много мусора/JS-кода | Чистый Markdown |
| Динамический контент | Часто не виден | Рендер как в браузере |
| Цена за запрос | От 0.50₽ | 0.10₽ |
| Риск зацикливания | Высокий (из-за неполных данных) | Минимальный (глубокая индексация) |
#Пример реализации лимита в коде
import requests def agent_search(query, max_budget=3): iterations = 0 context = "" while iterations < max_budget: # Открываем страницы полноценным браузером через наш API response = requests.post("https://srezai.ru/api/web_search", json={"query": query, "format": "markdown"}) data = response.json() if "error" in data or not data['results']: break context += data['results'][0]['content'] iterations += 1 # Логика агента: проверить, достаточно ли данных if check_sufficiency(context): break return contextПроверено
Почему агенты тратят так много токенов на поиск?
Агенты часто читают лишний HTML-код. срезAI выдает чистый Markdown, где JavaScript выполняется на нашей стороне, что сокращает объем входных токенов в 3-5 раз.
Как понять, какой Search Budget установить?
Для простых задач (поиск фактов) достаточно 1-2 итераций. Для глубокого ресерча (анализ рынка) оптимально 3-5 вызовов API.
Влияет ли скорость API на бюджет?
Да, высокая задержка заставляет агента дольше удерживать контекст в памяти. Наш p50 составляет 976ms, что ускоряет выполнение всей цепочки.
Можно ли ограничить глубину поиска в срезAI?
Да, через параметры API можно задать количество возвращаемых страниц и их объем, чтобы headless-браузер не передавал лишние данные.
Насколько срезAI дешевле конкурентов?
Наш поиск в 5 раз дешевле популярных западных и отечественных аналогов при сопоставимом качестве индексации Рунета.
Начните экономить бюджет поиска уже сегодня
Получить 1000 бесплатных запросовСвой веб-доступ для агента: поиск, чтение страниц и извлечение данных по одному ключу.

