Origem e Fontes de Dados
Combinamos dados abertos governamentais, parcerias privadas, crawlers próprios e modelos de inferência para construir o maior Big Data comercial de Pessoas e Empresas do Brasil.
Esta página descreve de onde vêm as informações que tratamos — inclusive as que podem se referir a você. Não coletamos dados diretamente do titular: eles provêm das fontes listadas abaixo. Para saber quais categorias de dados tratamos, com que finalidade e por quanto tempo, e para exercer seus direitos de acesso, correção, oposição ou eliminação, acesse o Portal de Transparência.
Como o Big DataSeek é construído
Todos os dados passam por etapas de validação e atualização antes de alimentar três grandes pilares.
Dados Abertos
- • Receita Federal (CPF, CNPJ, QSA, Simples)
- • ANATEL, ANS, IBGE, MTE/CAGED
- • Protestos, títulos e certidões
- • Portais de dados abertos
Dados de Terceiros
- • Empresas parceiras
- • Google Maps
- • Fornecedores de dados licenciados
- • Empresas gerenciadoras do Cadastro Positivo
- • Associações, confederações e sindicatos
Bases governamentais e dados abertos
Crawlers, redes sociais e fontes públicas
Além das bases oficiais, mantemos uma operação contínua de captura e qualificação de informações públicas disponíveis na web.
Crawlers de páginas web
Robôs proprietários que capturam informações de ambientes públicos (sites corporativos, portais governamentais, portais setoriais) com respeito a robots.txt e boas práticas.
Bancos de currículos
Coleta pública de perfis profissionais para compor atributos de ocupação, formação e experiência.
Perfis públicos em redes sociais
LinkedIn, Facebook, Instagram, YouTube, TikTok, Twitter/X e WhatsApp Business — informações expostas publicamente pelos próprios titulares.
Fontes públicas e governamentais
Diários oficiais, portais de transparência, publicações regulatórias e bases abertas (dados.gov.br, IBGE, MTE, entre outras).
Dados compartilhados por empresas e entidades
Coletas, validações e inferências
Cruzamento de dados
Combinamos informações de múltiplas fontes para gerar atributos derivados com mais precisão e cobertura.
Inferência estatística e machine learning
Faixa de renda, faturamento, classe social, market share e score são estimados por modelos internos treinados em dados reais.
Validação de e-mail
Processos internos que verificam deliverabilidade junto a provedores e detectam spam traps, domínios temporários e caixas inativas.
Validação de telefone
Histórico de portabilidade, identificação de operadora e testes de atendimento ("alô") em tempo real via ABRT.
Validação de identidade
Fluxos internos com acordos de compartilhamento para confirmar dados cadastrais.
Dúvidas sobre nossas fontes?
Fale com nossos especialistas em dados para entender como garantimos qualidade, atualização e conformidade legal.
Documentos relacionados
As páginas abaixo se complementam. Juntas, reúnem as informações sobre o tratamento de dados pessoais realizado pela DataSeek.
Portal de Transparência
Quais dados tratamos, com que finalidade, por quanto tempo e como exercer seus direitos.
Origem e Fontes de Dados
Você está aquiDe onde vêm as informações: bases públicas, parcerias, coletas e modelos de inferência.
Política de Privacidade
Bases legais, compartilhamento, retenção, cookies e direitos do titular.
Política de Segurança da Informação
Como protegemos os dados sob nossa responsabilidade e como tratamos incidentes.
Para solicitações sobre seus dados pessoais, fale com o Encarregado (DPO): [email protected]