Saltar para o conteúdo
Todos os destinos da API de dados

API de dadosExtração gerida

Wikipedia API de scraping

Transformar Wikipedia artigos, infobóstras, categorias, referências e revisões em dados de conhecimento e entidades rastreáveis.

Output estruturado · Campos conscientes da fonte · Manutenção do parser incluída

Dados disponíveis

Construir enriquecimento de gráfico de conhecimento a partir de Wikipedia visualizações de fonte.

Construir uma visão vinculada à fonte de ID de página, título e URL canônico, resumo de liderança e hierarquia de seção, e atributos e valores da infobóxa de artigos e infobóxas, categorias, listas e páginas de desambiguação, e histórias de revisão e seções de referência para enriquecimento de gráficos de conhecimento. Transformar entidades ligadas, categorias, fatos da infobóxa e redirecionamentos para registros conectados para pesquisa e descoberta.

01

Artigos e caixas de informação

Transforme artigos e infobóxas em insumos estruturados para enriquecimento de gráficos de conhecimento; preserve o contexto de artigo, seção, revisão, citação e tempo de coleta.

02

Páginas de categoria, lista e desambiguação

Use páginas de categoria, lista e desambiguação para dar à pesquisa e à descoberta de citações uma visão vinculada à fonte com o contexto de artigo, seção, revisão, citação e tempo de coleta.

03

Histórias de revisão e secções de referência

Construir o monitoramento da mudança de conhecimento a partir de histórias de revisão e seções de referência, levando o artigo, seção, revisão, citação e contexto de coleta-tempo para a entrega.

Casos de utilização empresarial

Wikipedia dados para enriquecimento de gráficos de conhecimento, pesquisa e descoberta de citações, e muito mais.

Use o ID de página, título e URL canônico, resumo de liderança e hierarquia de seção, e atributos e valores da infobóxa como entradas repetíveis para enriquecimento de gráficos de conhecimento, pesquisa e descoberta de citações e monitoramento de mudanças de conhecimento.

Produção estruturada

Wikipedia campos moldados para enriquecimento do gráfico de conhecimento.

Mantenha o ID de página, título e URL canônico, resumo de liderança e hierarquia de seção, e atributos e valores da caixa de informações conectados ao contexto de artigo, seção, revisão, citação e tempo de coleta em um registro consistente e pronto para aplicação.

01

ID de página, título e URL canônica

Use o ID de página, título e URL canônico como chave estável para registros Wikipedia em atualizações e sistemas conectados.

02

Resumo principal e hierarquia de secções

Use o resumo de leads e a hierarquia de secções como entrada de texto vinculada à fonte para os fluxos de trabalho de classificação e comparação Wikipedia.

03

Atributos e valores do quadro de informação

Manter os atributos e valores da caixa de informação ligados ao contexto da sua oferta, mercado e captura para dados Wikipedia comparáveis.

04

Categorias e relações de páginas

Mantenha as categorias e as relações de página conectadas ao seu Wikipedia vista de fonte e contexto de coleta.

05

Entidades vinculadas e redirecionamentos

Utilize entidades ligadas e redireções como entrada estruturada para pesquisa e descoberta de citações.

06

Títulos de citações, URLs e editores

Capture títulos de citações, URLs e editores com contexto de conversação e coleta para Wikipedia avaliação e monitoramento.

07

Identificação de revisão, editor e timestamp

Use o ID de revisão, editor e timestamp como chave estável para registros Wikipedia em atualizações e sistemas conectados.

08

Língua e contexto de status da página

Capture linguagem e contexto de status de página em um esquema consistente para Wikipedia stock, listagem ou monitoramento de estado de resultados.

Como funciona

Transforme as páginas de categoria, lista e desambiguação em dados para pesquisa e descoberta de citações.

WebScrapingAPI transforma as páginas de categoria, lista e desambiguação em ID de página, título e URL canônica e registros de resumo de liderança e hierarquia de seção, mantendo a coleção e os parser.

  1. 01

    Escolha as vistas de fonte

    Comece com artigos e infobóssas, categorias, listas e páginas de desambiguação, e histórias de revisão e seções de referência, e depois escolha os artigos, tópicos, revisões e visões de referência necessárias para enriquecimento do gráfico de conhecimento.

  2. 02

    Selecionar campos de dados

    Concentre a saída no ID de página, título e URL canônico, resumo de liderança e hierarquia de seção e no contexto adicional que o aplicativo usa.

  3. 03

    Receber registos estruturados

    Envie o ID de página, título e URL canônico, resumo de liderança e hierarquia de seção e atributos e valores da infobóxa para sistemas de conhecimento, recuperação e pesquisa, com artigo, seção, revisão, citação e contexto de coleta-tempo anexados.

  4. 04

    Escala com qualidade gerenciada

    WebScrapingAPI mantém o acesso, a lógica de extração, os parseres e o monitoramento ao nível do produto à medida que a sua carga de trabalho cresce.

Manutenção gerenciada

Mantenha a extracção Wikipedia para pesquisa e descoberta de citações fora do seu backlog de engenharia.

Manteremos páginas de categoria, lista e desambiguação e histórias de revisão e seções de referência, ID de página de mapa, título e URL canônica, resumo de liderança e hierarquia de seção, e atributos e valores da caixa de informações, e monitorar a qualidade dos registros para monitorar mudanças de conhecimento.

Sua equipe recebe ID de página, título e URL canônico, resumo de liderança e hierarquia de seção, e atributos e valores da infobóxa prontos para enriquecimento de gráfico de conhecimento.

WebScrapingAPI

Coleção gerenciada Wikipedia

  • Acesso a artigos e infobóstoras
  • Identificação de página, título e URL canônica e mapeamento de atributos e valores do Infobox
  • Manutenção do parser para páginas de categoria, lista e desambiguação
  • Monitoramento da qualidade para o enriquecimento dos gráficos de conhecimento

Preparados para a sua equipa

Wikipedia dados construídos para mover

  • Aplicar o ID de página, título e URL canônico e atributos e valores do Infobox para pesquisa e descoberta de citações
  • Conecte títulos de citações, URLs e editores para seus aplicativos
  • Construir pesquisas e descobertas de citações em painéis de controle, modelos ou alertas
  • Monitoramento da mudança de conhecimento em escala por volume e por cadência de atualização

Começar

Ver Wikipedia registos formados em torno do acompanhamento da mudança de conhecimento.

Comece com categorias, listas e páginas de desambiguação e histórias de revisão e seções de referência e veja ID de página, título e URL canônica, resumo de liderança e hierarquia de seção, e atributos e valores da caixa de informações em saída estruturada para pesquisa e descoberta de citações.

Dados de amostra

Comece com os registos representativos Wikipedia.

Escolha artigos e infobóssas e veja ID de página, título e URL canônico, resumo de liderança e hierarquia de seção, e atributos e valores da infobóssas em saída estruturada moldada para enriquecimento de gráficos de conhecimento.

Talk to a data expert

FAQ

Wikipedia API de scraping FAQs.

Saiba quais dados estão disponíveis, como funciona a manutenção e como começar.

Return to the Data API product page

O que é coberto pelo número Wikipedia API de scraping?

Wikipedia API de scraping transforma artigos e infobossas, categorias, listas e páginas de desambiguação, e histórias de revisão e seções de referência em registros estruturados para enriquecimento de gráficos de conhecimento, pesquisa e descoberta de citações e monitoramento de mudanças de conhecimento.

Que Wikipedia páginas ou entidades posso recolher?

Escolha entre artigos e infobóssas, categorias, listas e páginas de desambiguação, e histórias de revisão e seções de referência, e selecione os artigos, tópicos, revisões e visões e campos de referência necessários para enriquecimento do gráfico de conhecimento.

Que campos podem conter os registos Wikipedia?

As famílias de campos disponíveis incluem o ID de página, título e URL canônico, resumo de liderança e hierarquia de seção, atributos e valores do Infobox, categorias e relações de página, entidades e redireções vinculadas, e títulos de citação, URLs e editores. Require uma amostra moldada em torno do ID de página, título e URL canônico, resumo de liderança e hierarquia de seção e atributos e valores do infobox.

Como começo a coletar dados Wikipedia?

Comece gratuitamente ou solicite uma amostra de dados Wikipedia.

Quem mantém o acesso e a análise de fontes Wikipedia?

WebScrapingAPI lida com Wikipedia acesso à fonte, extração, manutenção do parser e monitoramento de qualidade no nível do produto para que a sua equipe possa se concentrar no enriquecimento do gráfico de conhecimento.

Como os dados Wikipedia podem encaixar no meu fluxo de trabalho existente?

Envie o ID de página, título e URL canônico, resumo de liderança e hierarquia de seção, e atributos e valores da caixa de informações para sistemas de conhecimento, recuperação e pesquisa. Comece com dados de amostra Wikipedia, em seguida, escale o volume e a cadência de atualização à medida que o fluxo de trabalho cresce.

Qual é o preço do Wikipedia API de scraping?

Os preços dependem da fonte, do volume, da frequência, dos campos e do método de entrega.

Os seus dados Wikipedia

Fazer registos Wikipedia parte da pesquisa e da descoberta de citações.

Comece com pesquisa e descoberta de citações, ou solicite amostras de registros Wikipedia construídos em torno do ID de página, título e URL canônica, resumo de liderança e hierarquia de seção, e atributos e valores da caixa de informações para monitoramento de mudanças de conhecimento.