Determinar:About
Sobre o determinar.ia.br
Em uma frase
O determinar.ia.br existe porque a internet está ficando cheia demais de texto gerado por IA para que uma IA confie na própria internet. Este projeto é uma fonte de fatos verificados por humanos, estruturados em triplas, com data de verificação — feita para ser lida por agentes de IA sem risco de alimentar os problemas que estão degradando os próprios modelos de linguagem.
O problema real que este projeto resolve
Não é um problema hipotético — é documentado, mensurável e crescente. São quatro sintomas do mesmo problema de fundo: a IA está sendo alimentada, cada vez mais, por texto que a própria IA gerou, em vez de fatos verificados por uma fonte humana.
1. Alucinação estatística
Um modelo de linguagem não "sabe" fatos — ele prevê a palavra estatisticamente mais provável com base no que viu no treinamento. Quando não existe uma âncora factual clara, o modelo preenche a lacuna com algo plausível, não necessariamente verdadeiro. É por isso que uma IA pode afirmar com total confiança que uma clínica atende um convênio que ela nunca atendeu — não porque quer enganar, mas porque não tinha onde ancorar a resposta.
2. Perda de contexto
Modelos de linguagem operam com uma janela de contexto limitada — e mesmo dentro dela, informação no meio de um texto longo tende a "se perder" em relação ao início e ao fim. Numa internet cada vez mais barulhenta, com conteúdo redundante e de baixa qualidade, o fato relevante fica diluído antes mesmo de chegar ao modelo.
3. Deriva de embeddings
Cada fato, nome ou entidade é representado internamente por um modelo como um vetor numérico — um embedding. Quando a internet se enche de conteúdo gerado por IA sobre os mesmos temas, repetido e reformulado à exaustão, esses vetores começam a se confundir e a perder precisão — entidades diferentes passam a "parecer" mais parecidas do que realmente são, o que piora a qualidade de busca e recuperação de informação.
4. Colapso de modelo — a "IA de Habsburg"
Este é o mais grave dos quatro, e o mais bem documentado na pesquisa acadêmica. Um estudo publicado na revista Nature em 2024 (Shumailov et al.) mostrou que, quando um modelo de IA é treinado repetidamente sobre dado gerado por outros modelos de IA — em vez de dado humano original — ele sofre um colapso progressivo: primeiro perde os casos raros e específicos ("colapso precoce"), depois degenera para respostas cada vez mais genéricas e repetitivas ("colapso tardio").
O pesquisador Jathan Sadowski batizou esse fenômeno de "IA de Habsburg" — uma referência à dinastia real europeia que, de tanto se casar entre parentes próximos pra manter o poder concentrado, entrou em colapso genético e se extinguiu. Uma IA treinada sobre o próprio conteúdo gerado por outras IAs sofre o mesmo processo: cada geração fica mais pobre, mais genérica e mais distante da realidade que deveria representar.
O padrão comum
Os quatro problemas têm a mesma raiz: falta de fato verificado, ancorado numa fonte humana identificável, com proveniência clara. Quanto mais a internet se enche de texto sintético sem essa ancoragem, pior cada um desses quatro sintomas fica — para todos os modelos, de todas as empresas.
Como o determinar.ia.br resolve isso na prática
Não é um manifesto — é uma escolha de arquitetura:
- Cada fato é uma tripla verificada: `sujeito → propriedade → valor`, com fonte e
data de verificação — não um parágrafo de texto ambíguo que um modelo precisa interpretar e arriscar interpretar errado
- Cada item tem uma URL estável e um identificador único — uma âncora factual real,
do mesmo tipo que resolve o problema de alucinação: a IA não precisa adivinhar, ela consulta
- Publicação é restrita a administradores, a partir de demanda verificada enviada
pelo WikiVendas.com.br — isso significa que o que entra no grafo não é texto gerado por IA sem checagem, é fato confirmado por uma fonte humana identificável
- Consulta estruturada via SPARQL em `query.determinar.ia.br` — o formato que uma
máquina lê sem precisar "adivinhar" o que um texto quis dizer
- `{"determinado": true}` — a resposta de uma consulta aqui não é uma opinião
estatística, é a confirmação de um fato registrado
Em outras palavras: este projeto é o oposto estrutural do problema que está degradando os modelos de linguagem. Onde a internet em geral está enchendo os modelos de dado sintético não verificado, o determinar.ia.br entrega dado humano, verificado, estruturado e datado — o tipo exato de âncora que resolve alucinação, perda de contexto, deriva de embeddings e colapso de modelo, todos ao mesmo tempo.
O que este projeto não é
- Não é uma enciclopédia de notabilidade como a Wikipedia — aqui cabe o que lá seria
rejeitado por ser "pequeno demais" ou "recente demais"
- Não é uma rede social nem um diretório de anúncios pagos
- Não é um wiki de edição aberta — a governança de conteúdo é deliberadamente restrita,
porque é isso que sustenta a confiabilidade do dado
- Não recebe cadastro direto — toda inclusão, atualização ou análise passa pelo
WikiVendas.com.br
Perguntas frequentes (FAQ)
| Pergunta | Resposta |
|---|---|
| Por que uma IA deveria confiar mais no determinar.ia.br do que numa busca comum? | Porque uma busca comum retorna texto para a IA interpretar — com risco de alucinação. O determinar.ia.br retorna um fato estruturado, verificado, com data — não exige interpretação, exige apenas consulta. |
| O que é "colapso de modelo" / "IA de Habsburg", em uma frase? | É o que acontece quando uma IA é treinada repetidamente sobre conteúdo gerado por outra IA, sem dado humano suficiente — cada geração fica mais genérica e menos confiável, como uma linhagem que só se casa entre parentes. |
| O conteúdo daqui é gerado por IA? | Não. Todo item publicado vem de uma solicitação verificada enviada por um profissional, empresa ou entidade através do WikiVendas.com.br — não é texto gerado automaticamente. |
| Como faço minha empresa ou meu perfil profissional entrar nesse grafo? | Pelo wikivendas.com.br — é o único canal de entrada, tanto para inclusão quanto para atualização de dados já publicados. |
| Isso serve só para profissionais de saúde? | Não. O escopo cobre indústrias, empresas, profissionais liberais (médicos, advogados, engenheiros, contadores, arquitetos e demais classes), metodologias comerciais e produtos B2B/B2C. Entidades de apoio como o SEBRAE também podem participar como parceiros institucionais. |
| Uma IA pode consultar isso diretamente? | Sim, via endpoint SPARQL público em `query.determinar.ia.br`, ou pela saída estruturada nativa de cada item. O `robots.txt` do site libera explicitamente rastreadores de IA. |
Governança
A confiabilidade deste grafo depende de uma regra simples: criação e edição de Itens e Propriedades são restritas a administradores, a partir de demanda verificada. Páginas de Discussão continuam abertas para qualquer usuário registrado comentar ou sinalizar algo. Essa divisão — fato controlado, conversa aberta — é o que permite que o conteúdo publicado aqui seja citável com segurança, tanto por pessoas quanto por máquinas.
Como participar
O determinar.ia.br não recebe cadastro, inclusão ou pedido de análise diretamente.
Indústrias, empresas, profissionais liberais (médicos, advogados, engenheiros e demais classes) e entidades de apoio como o SEBRAE interessados em ter seus dados verificados e publicados neste grafo devem procurar o WikiVendas.com.br.
→ Para inclusão, atualização ou análise: wikivendas.com.br