Выберите нужный формат
Markdown для моделей, HTML для собственной обработки, ссылки для навигации и метаданные для каталога.
Получайте Markdown, HTML, ссылки и метаданные публичных страниц. Для одного URL, списка страниц или целого сайта.
example.com/article{
"title": "Документация",
"content": "Чистый текст...",
"links": 24
}/v1/scrapeОдна страница/v1/contentsДо 100 URL/v1/mapКарта сайта/v1/crawlОбход сайтаМы возвращаем полезное содержимое страницы в предсказуемой схеме. Вам не нужно поддерживать загрузчики, очистку, очереди и повторные попытки.
Markdown для моделей, HTML для собственной обработки, ссылки для навигации и метаданные для каталога.
/v1/contents получает содержимое списка URL и возвращает статус по каждой странице.
map находит адреса, а crawl обходит страницы асинхронно с контролем результата.
Подпишитесь на webhook и получите уведомление, когда большой обход будет готов.
Один URL, список страниц или начальный адрес сайта.
Текст, Markdown, HTML, ссылки, метаданные или полный обход.
Отправьте данные в агента, RAG, аналитику, CRM или собственное хранилище.
Давайте агенту актуальный контент страницы без меню, рекламы и лишней разметки.
Собирайте документы для индексации, поиска и ответов по собственному корпусу.
Получайте карточки, статьи, ссылки и метаданные в едином формате.
Постройте карту старого сайта и перенесите нужные страницы без ручного копирования.
curlcurl https://api.llmtokenapi.ru/v1/scrape \
-H "Authorization: Bearer $LLMTOKENAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"url": "https://example.com/article",
"formats": ["markdown", "links", "metadata"]
}'Авторизация через Bearer key, стабильные коды ошибок и единый requestId для диагностики.
{
"object": "web.document",
"data": {
"markdown": "# Заголовок\nЧистый текст страницы...",
"links": ["https://example.com/docs"],
"metadata": { "title": "Заголовок" }
},
"usage": { "requests": 1 }
}Все параметры API Да. Для таких страниц в запросе scrape можно включить рендеринг и задать время ожидания.
Только публично доступные HTTP/HTTPS‑страницы. Внутренние адреса заблокированы, robots.txt учитывается, обход CAPTCHA не предоставляется.
Тела синхронных scrape и contents ответов не сохраняются. Результаты асинхронных map и crawl шифруются и автоматически удаляются через 24 часа.
Да. После подтверждения почты рабочая область получает 150 ₽ пробного баланса на 30 дней. Его можно использовать для моделей, поиска, получения и очистки страниц, извлечения данных, карт сайтов, обхода и исследований.