Busca pública com NLWeb
Consulte o site e a documentação da Siglata em linguagem natural, com resultados e fontes em JSON ou SSE.
O endpoint https://www.siglata.com/ask busca nas páginas públicas e na documentação da Siglata. Ele retorna páginas relevantes com título, descrição, idioma e URL da fonte. Não exige autenticação e não acessa arquivos de organizações.
Consultar
curl https://www.siglata.com/ask \
-H 'Content-Type: application/json' \
-d '{"query":{"text":"Como funciona o piloto?","max_results":5},"prefer":{"mode":"list","response_format":"conv_search","streaming":false,"accept-language":"pt-BR"}}'
Também é possível usar GET /ask?query=planilhas&streaming=false. O parâmetro lang=en-US seleciona o conteúdo em inglês; o padrão é português. Em POST, use prefer.accept-language. O cabeçalho Accept-Language é usado quando não há preferência explícita.
Cada resultado inclui grounding.source_urls com a página que sustenta a resposta. A classificação usa busca textual com Orama sobre o conteúdo publicado. O modo list recupera páginas; não gera respostas com um modelo de linguagem nem executa ações.
Respostas e limites
- JSON:
prefer.streaming: falseou cabeçalhoAccept: application/json. - SSE:
prefer.streaming: true; a resposta contém um eventodata:com os resultados e encerra a conexão. SSE é o padrão quando não há preferência por JSON. - Até 1.000 caracteres na consulta, 8 KiB no corpo e 20 resultados; o padrão é 5.
- Consultas sem correspondências retornam
results: []. - Requisição inválida: 400; método incompatível: 405; corpo grande: 413; tipo de conteúdo incorreto: 415; busca indisponível: 503.
Esta implementação usa o perfil list / conv_search dos modelos NLWeb 0.54. Modos de resumo, histórico de conversa, memória persistente, busca em outros sites e formatos diferentes não são suportados. Campos de POST fora do perfil documentado são rejeitados.
Descoberta
- Descrição OpenAPI do NLWeb
- Catálogo público em Schema.org DataFeed
- Mapa dos feeds estruturados
- Páginas públicas em JSON Lines
- Índice para agentes
O mapa segue a proposta Schema Feeds 0.1, anunciada em robots.txt. Cada linha do feed contém uma página em JSON-LD, com idioma, texto e URL da fonte. Os dois formatos são gerados das mesmas páginas públicas a cada publicação do site.
A documentação também oferece WebMCP para agentes no navegador. O MCP de organizações em /v1/mcp é uma interface separada: exige OAuth e mantém os escopos de acesso aos arquivos.