Como capturar uma página no editor

Esta página pede ao servidor do VoriTools que solicite um endereço web e coloca o HTML recebido em um editor. É uma ferramenta de captura e edição, não um leitor de artigos: o que aparece é o código da resposta, sem extração de texto.

A requisição é feita pelo servidor, então o site de destino vê o VoriTools e não o seu navegador. Cookies, login e estado do cliente não são enviados, e páginas que dependem deles voltam como tela de acesso ou não voltam.

  1. Cole no campo ao lado do botão o endereço completo de uma página acessível publicamente, incluindo http:// ou https://.
  2. Pressione Buscar página. A requisição é feita pelo servidor do VoriTools; a ferramenta segue até cinco redirecionamentos e desiste após 30 segundos.
  3. Aguarde a resposta. Quando ela chegar, o HTML recebido preenche o editor; o campo de endereço mantém a URL enviada para uma nova tentativa.
  4. Revise ou edite o conteúdo com a barra de ferramentas, rotulada no idioma desta página. Scripts e manipuladores de eventos embutidos são removidos pelo filtro do editor antes de qualquer exibição.
  5. Selecione e copie o que precisar; ao enviar outro endereço, o conteúdo anterior é substituído. As falhas aparecem em um aviso acima do formulário, em vez de deixar o editor vazio sem explicação.

O que a captura faz e onde ela para

Uma requisição do servidor, não uma visita do navegador

A requisição sai do servidor do VoriTools, e é por isso que esta página consegue mostrar o código de uma URL que a sua rede talvez não alcance. Endereços privados, de loopback, de enlace local e de metadados de nuvem são recusados antes da conexão: endereços como 127.0.0.1 ou 169.254.169.254 retornam uma explicação em vez de conteúdo.

Nada da sua sessão do navegador acompanha o pedido: sem cookies, sem login, sem o seu referenciador. O site de destino decide como responder, e muitos sites grandes respondem a requisições automáticas com uma página de consentimento, um desafio ou um bloqueio em vez do artigo.

O que o editor realmente mostra

O editor contém o corpo da resposta como HTML, então marcação, atributos alt e estilo embutido sobrevivem e a página fica editável. O filtro do editor remove scripts e manipuladores de eventos, o que impede que uma página capturada execute código na sua sessão; a visão de código-fonte HTML mostra o resultado filtrado.

Links e imagens da página capturada mantêm seus endereços originais. URLs absolutas continuam apontando para o site de origem, enquanto as relativas são resolvidas contra esta página e normalmente quebram: um documento que dependa de recursos relativos parecerá incompleto mesmo com o HTML intacto.

Quando a captura volta vazia

Uma resposta que não seja texto — imagem, PDF, fonte ou download — não pode ser exibida aqui e deixa o editor vazio com um aviso. Tempo esgotado, nome que não resolve, status HTTP de erro e corpo vazio são informados separadamente, para que o motivo da falha continue legível.

Páginas construídas em JavaScript devolvem a estrutura inicial em vez do conteúdo renderizado, porque a captura não executa scripts. Pelo mesmo motivo, uma página atrás de login ou de verificação anti-bot devolve o que um visitante anônimo receberia. O editor mostra um instantâneo de uma resposta, não uma visão ao vivo do site.

Ferramentas recentes: