Extrator de URL

3.67 de 3 avaliações

O Extrator de URL é uma ferramenta gratuita que encontra URLs HTTP e HTTPS em texto colado e indica quantas foram detetadas.

Como extraio URLs de um texto?

Cola o texto de origem no campo de entrada, inicia a extração e verifica a Contagem.

  1. Copia o texto que contém os endereços Web.
  2. Cola-o na ferramenta e inicia a extração.
  3. Verifica a Contagem.

A contagem é útil quando já sabes aproximadamente quantas ligações devem existir. Se as instruções de uma campanha indicarem que existem 20 referências, mas o resultado mostrar 19, podes verificar o conteúdo original antes de o enviares.

Em que situações é útil extrair URLs?

A extração de URLs poupa tempo sempre que as ligações estão misturadas com frases, etiquetas, comentários ou outros dados desnecessários.

  • Registos de apoio ao cliente: reúne ligações copiadas de pedidos do Zendesk ou de conversas do Microsoft Teams antes de analisares as páginas comunicadas.
  • Trabalho de conteúdos: extrai referências de um documento do Word ou de um rascunho no WordPress ao verificares fontes, redirecionamentos ou ligações internas.
  • Exportações de folhas de cálculo: recupera endereços Web de notas exportadas do Google Sheets ou do Excel sem teres de verificar manualmente cada célula.
  • Preparação de impressão em série: separa as ligações de destino do texto descritivo antes de as colocares numa coluna de URLs de um ficheiro CSV.
  • Verificações de migração: encontra ligações absolutas no conteúdo copiado de páginas antes de transferires artigos entre sistemas de gestão de conteúdos.

O que é considerado um URL?

Nesta ferramenta, os endereços relevantes são URLs que começam por http:// ou https://. Um domínio isolado, como example.org, um endereço com www mas sem esquema, um endereço de email e um caminho relativo, como /contact, são tipos de dados diferentes.

Um URL pode incluir um domínio, uma porta, um caminho, uma cadeia de consulta e um fragmento. Estes componentes podem conter números. Os espaços literais não são caracteres válidos num URL e costumam ser codificados, muitas vezes como %20, embora muitos sistemas modernos utilizem outras estruturas em vez de espaços.

Os nomes de domínio internacionalizados podem surgir como texto Unicode ou no formato Punycode compatível com ASCII. Como a extração de texto se baseia na correspondência de padrões de caracteres, verifica estes endereços com atenção em vez de partires do princípio de que todas as aplicações os interpretam da mesma forma.

Exemplos de entrada e resultado

Entrada

Project brief https://example.org/brief

Archive copy http://example.net/archive

Contagem 2

Um URL também pode incluir um caminho e parâmetros de consulta.

Entrada

Review order https://example.org/orders/1042?status=open

Contagem 1

Como verifico uma entrada problemática?

Analisa as correspondências junto a sinais de pontuação, parênteses ou quebras de linha, porque os limites do URL pretendido nem sempre são claros em texto simples. Um ponto final pode pertencer à frase envolvente. Os caracteres reservados literais, incluindo vírgulas e parênteses, só são permitidos em determinados contextos de um URL. Quando recebem codificação percentual, surgem como sequências de bytes codificadas com percentagem, e não como caracteres literais.

Um texto que não contenha qualquer endereço HTTP ou HTTPS não tem URLs elegíveis para extração.

A ferramenta utiliza correspondência de padrões e não interpreta o significado de cada página. Não consegue deduzir um esquema em falta, reparar uma ligação dividida entre várias linhas nem decidir se um sinal de pontuação próximo foi introduzido por engano.

Perguntas frequentes

A ferramenta extrai endereços com www sem HTTP ou HTTPS?

Não. Adiciona o esquema completo, como https://www.example.org, se quiseres que o endereço seja tratado como um URL HTTP ou HTTPS. Não adiciones um esquema indiscriminadamente a texto não fiável ou malformado.

O extrator verifica se uma ligação está ativa?

Não. A correspondência de padrões identifica texto com o formato de um URL, mas não confirma se o domínio existe, se o servidor responde ou se a página é segura. Verifica as ligações separadamente antes de as publicares ou de abrires endereços que não conheces.

É possível extrair ligações relativas de HTML?

A ferramenta consegue identificar URLs HTTP ou HTTPS absolutos presentes no texto colado, incluindo os que fazem parte de código-fonte HTML. Um valor relativo, como href="/pricing", não contém o esquema obrigatório e precisa do endereço base do site para se tornar um URL absoluto.

O texto que colo é enviado para um servidor?

Sim. O conteúdo introduzido é enviado para o servidor através de HTTPS, onde é realizada a extração, e não é armazenado. Evita colar segredos, palavras-passe ou tokens de acesso privados em qualquer ferramenta de texto, sobretudo quando aparecem em cadeias de consulta de URLs.

A extração remove parâmetros de rastreio?

Não pressuponhas que a ferramenta limpa os URLs ou remove parâmetros de rastreio. Antes de partilhares URLs extraídos do conteúdo original, verifica as cadeias de consulta, como etiquetas de campanha, identificadores de sessão e parâmetros assinados, pois podem expor informações ou alterar o destino da ligação.

Ferramentas Populares