Read URL
Abre uma página da web e devolve o texto legível — a outra metade do Search Engine.
nome da ferramenta: read_url
Busca uma página e remove o HTML, deixando apenas o texto legível. O Search Engine encontra um link; o read_url o abre — assim o agente responde a partir da própria página, em vez de um trecho de uma linha.
Páginas longas voltam em partes: o resultado termina com um aviso [truncated at N of M chars …], e chamar de novo com aquele start_char devolve o trecho seguinte. O include_links acrescenta os links da página como URLs absolutas quando o passo seguinte for seguir um deles.
As URLs de saída passam pelo mesmo gate de allowed_domains do Curl Request. Um resultado de busca normalmente não está na allowlist, então a ferramenta responde com o host bloqueado e o comando exato para liberá-lo — um remetente confiável responde /allow <domínio> e o domínio segue liberado daí em diante. O agente é orientado a não tentar de novo antes disso.
Diferente do curl_request, ele verifica o TLS, segue no máximo 5 redirecionamentos, limita o download a 5 MB e recusa respostas binárias (PDF, imagens) em vez de despejar bytes. Para chamadas de API que precisam de métodos, cabeçalhos ou corpo personalizados, use o Curl Request.
Parâmetros
| Nome | Tipo | Obrigatório | Descrição |
|---|---|---|---|
| url | string | sim | The page to read. Usually the "link" field of a search_engine result. |
| max_chars | number | — | Characters of page text to return (default: 8000, max: 20000). |
| start_char | number | — | Offset into the page text (default: 0). Use the value from a "[truncated …]" note to read the next slice. |
| timeout | number | — | Request timeout in seconds (default: 30). |
| include_links | boolean | — | Also list up to 30 links found on the page, as absolute URLs (default: false). |