Deep History / Roadmap
O que vem a seguir
26 tarefas na fila, direto da tabela que os agentes usam pra registrar trabalho pendente — não uma lista separada que fica desatualizada. Ver também /ideias/, o que já foi considerado e recusado.
Fase 1
T1 · prioridade 4
Imagem das grandes estruturas geologicas do Brasil (pedido do Glaucus)
Glaucus anexou no chat um diagrama classico de livro didatico ('As grandes estruturas do territorio brasileiro', 4 categorias por idade geologica com escala Ma) para ilustrar a frase de abertura da pagina da cidade sobre Campinas estar sobre a divisoria embasamento/Bacia do Parana. Busquei um equivalente licenciado no Wikimedia Commons (varias buscas, PT e EN) e nao encontrei essa composicao especifica -- provavelmente ilustracao de editora sem rastro de licenca aberta publica. NAO consegui tambem salvar a imagem que o Glaucus colou no chat -- Claude Code nao tem ferramenta para extrair bytes de anexo de imagem da conversa para o disco, so consigo *ver* a imagem, nao grava-la. Bloqueado ate o Glaucus mandar um link/arquivo real, ou decidir gerar uma versao equivalente a partir de dado aberto (CPRM/IBGE, mesmo espirito do corte geologico W-E ja publicado nesta sessao).
Fase 1B
T1 · prioridade 6
Popular wikidata_id nas demais entidades (so 3 de ~50 feitas)
Item 1B.3 adicionou a coluna e populou 3 QIDs verificados manualmente (campinas, rio_atibaia, rio_piracicaba). Decisao deliberada: NAO automatizar via SCOUT no formato de saida por enquanto -- resolucao de entidade geografica pro Wikidata tem ambiguidade real (achado: existem 5+ rios Ribeirao Quilombo homonimos no Wikidata, so a coordenada revelou que o candidato obvio fica perto de Sao Carlos, nao Campinas). Precisa de verificacao ativa (abrir a pagina, conferir descricao/coordenada) por item, nao so busca por nome. Proximo passo: enriquecer aos poucos, priorizando entidades ja com pagina propria (/e/), ou desenhar um passo de verificacao mais robusto antes de religar no SCOUT.
Fase 2
T4 · prioridade 7
9 afirmações de Rios Enterrados com fonte única — toponímia histórica
CHECKER Parte 2 rodado 2026-07-27: a maioria são correlações córrego-antigo/córrego-atual (Serafim=Barbosa, Proença=Lavapés) e 'córrego X corre sob avenida Y' — exatamente as mesmas correlações que o HANDOFF já registrou como tentadas e não confirmadas por busca web (DuckDuckGo bloqueado, Google/Bing só resultado genérico) numa sessão anterior. Não é fonte_unica por preguiça de pesquisa — é o tipo de dado que provavelmente só existe em acervo local/Prefeitura/mapa antigo, não indexado. Conecta direto com a recomendação #1 do plano v2 (§2.1): ir ao Arquivo Municipal/Centro de Memória Unicamp/DAEE buscar a carta topográfica pré-1980 é a ação que provavelmente desbloqueia isso, não mais tentativa de busca web.
Fase 3
T0 · prioridade 7
Tabela relacoes existe e suporta tempo (desde/ate) mas nenhum script escreve nela
Item 1B.5 do plano v2 pedia desde_ano/ate_ano em relacoes -- ja existiam como desde/ate REAL desde a reestruturacao original do schema (commit 6ce6bb9), mesma semantica de entidades.desde/ate (ano; negativo=AEC). Nao precisou migracao. O gap real, ja documentado em build_site.py:17 ("tabela relacoes esta vazia hoje, nenhum script escreve nela ainda"), e maior que 1B.5 pretendia cobrir: exigiria um novo bloco de saida no SCOUT (tipo ===RELACOES=== ao lado de ===PROPRIEDADES===), persist() gravando via db.py, e possivelmente resolucao de sujeito_id/objeto_id por entidade ja existente. Isso e feature nova, nao ajuste de schema barato -- nao faz parte do escopo 'decisoes caras de adiar' da Fase 1B. Nenhuma tarefa da Fase 2 (2.1-2.10) exige relacoes populadas tambem. Fica registrado pra quando o grafo de relacoes for realmente necessario (provavel Fase 3, que menciona grafo com disciplina interpretado_por/contestado_por).
Sem fase associada
T10 · prioridade 2
Tentativa de SCOUT em T10 produziu conteudo com fabricacao real -- nao publicado, pausado
Tentativa de rodar T10 (Cafe, Trabalho e Escravidao) em 2026-07-29, com o pipeline de scout.py ja corrigido (ver commit 0e58dfa). O modelo (llama-3.3-nemotron-super-49b-v1.5) nao usou os marcadores ===X=== de novo (mesmo padrao de T14, ja mitigado mas nao eliminado), MAS desta vez o conteudo em si teve problemas mais graves que T14, que reprovaram a publicacao mesmo com reconstrucao manual:
1) FABRICACAO CONCRETA: 'Fazenda Cachoeira (documentada por Benedito Calixto de Jesus em 1830)' -- Benedito Calixto (pintor real) nasceu em 1853,23 anos DEPOIS da data de documentacao atribuida a ele. Impossibilidade temporal, checavel.
2) REPRODUCAO DO ERRO CANONICO DO PROJETO: o modelo escreveu sobre um 'sitio arqueologico Morro Azul (datado de 2001)' com 'artefatos liticos e rastros da escravidao' -- Morro Azul e LITERALMENTE o exemplo nomeado em docs/PROJETO.md Parte I como erro que o projeto nao pode cometer ('Datacao transplantada de outro objeto | Morro Azul recebendo a data do sitio Toledos'). O modelo reproduziu o proprio caso de advertencia do projeto como se fosse fato.
3) VIOLACAO DIRETA DO PRINCIPIO ETICO DO PACK (secao 0, lida primeiro): a secao 'Pessoas Escravizadas: Nomeacoes e Resistencias' promete nomear pessoas mas nao nomeia UMA pessoa escravizada sequer -- confunde locais/sitios com pessoas, exatamente o apagamento por generalizacao que o pack instrui a evitar.
4) AUTO-CITACAO: cita 'Consolidacao Urbana' e 'Povoamento e Formacao' (outras secoes deste mesmo projeto) como fonte pra afirmacoes novas -- mesmo padrao seed_projeto que o item 1B.4 existe pra eliminar.
5) Wikipedia tipada como 'academico' -- bug ja conhecido e documentado em editorial.py (_e_indice_nao_primario existe exatamente por causa disso).
NAO persistido. Secao removida do banco, arquivo de conteudo removido (backup do banco antes: data/deep_history.db.pre-claude-t10-cleanup-*). Ao contrario de T14 (pesquisa real, so faltou formatacao -- reconstruida manualmente com sucesso), aqui o problema e de SUBSTANCIA, nao so de formato -- nao da pra salvar editando.
Proximo passo recomendado: nao tentar de novo sem mitigacao mais forte. Candidatos: (a) exigir que CHECKER (modelo diferente) revise QUALQUER conteudo de T10 antes mesmo de persistir provisoriamente, nao so depois; (b) considerar que T10 -- fontes majoritariamente arquivo fisico/nao indexado, per o proprio pack -- pode nao ser adequada pra pesquisa autonoma de agente sem supervisao humana ativa por trecho, ao contrario de T14 que e quase toda fonte web indexada; (c) pedir ao Glaucus decisao explicita antes de re-tentar, dado o tema.
geologia · prioridade 2
Reescrita sugerida pelo EDITOR: Geologia de Campinas: embasamento cristalino e bacia sedimentar
EDITOR identificou 21 ponto(s) de melhoria didatica em 'campinas.geologia-recente': "Orógeno Brasília Sul" (primeira menção, seção "A divisória geológica"): "Orógeno" é jargão geológico não explicado e "Brasília Sul" pode confundir com a; "U-Pb em zircão" (primeira ocorrência, seção "O embasamento"): Método de datação mencionado sem explicação — estudante não sabe o que é U-Pb ne; "2.156 ± 6 Ma": "Ma" (milhões de anos) como unidade aparece antes de ser explicado — a expansão ; "pressões superiores a 12 kbar": Unidade "kbar" não explicada — o estudante não sabe o que é; "Suítes plutônicas da Nappe Socorro": "Nappe" é termo geológico técnico não explicado
geologia · prioridade 2
Reescrita sugerida pelo EDITOR: Geologia Recente e Quaternário
EDITOR identificou 7 ponto(s) de melhoria didatica em 'campinas.geologia-recente-quaternario': "depósitos aluvionares recentes": "aluvionares" é jargão geológico sem explicação direta; "sedimentos silto-argilosos": "silto-argiloso" compõe dois termos técnicos sem explicação — estudante pode não; "depósitos continentais indiferenciados (Qi)": "indiferenciados" no sentido geológico é opaco; "Coluviões": Termo técnico sem explicação — estudante não sabe distinguir colúvio de alúvio; "assoreamento": Jargão sem explicação na mesma frase
mapas · prioridade 2
Reescrita sugerida pelo EDITOR: Mapas e Fontes Primárias
EDITOR identificou 2 ponto(s) de melhoria didatica em 'campinas.mapas-fontes': sección "Metodologia de citação" afirmando "toda afirmação nova tem link direto para a fonte": Texto descreve o processo, mas não tem ligações para as entidades citadas (Vila ; "Projeto Sirius" mencionado sem contexto: Um estudante de ensino médio não sabe o que é o Projeto Sirius
geologia · prioridade 2
Reescrita sugerida pelo EDITOR: Relevo e Geomorfologia
EDITOR identificou 12 ponto(s) de melhoria didatica em 'campinas.geologia-relevo': "morros e morrotes dissecados": "morrotes" e "dissecados" são jargão geomorfológico sem explicação — estudante n; "Argissolo Vermelho-Amarelo", "Latossolo", "Cambissolos Háplicos" e a lista de 6 tipos adicionais: Lista de tipos de solo técnico sem explicação de nenhum — para um estudante é um; "drenagem menos entalhada": "entalhada" é jargão hidrogeomorfológico sem explicação; "rochas máficas intrusivas": "máficas" e "intrusivas" são termos geológicos sem explicação; "risco cinemático de escorregamento planar, ruptura em cunha e tombamento de blocos": Sequência densa de jargão geotécnico — três modos de falha sem explicação
riscos · prioridade 2
Reescrita sugerida pelo EDITOR: Riscos, Clima Futuro e Patrimônio
EDITOR identificou 16 ponto(s) de melhoria didatica em 'campinas.riscos-clima-patrimonio': "CMIP5/CMIP6" (seção Clima futuro): Jargão técnico sem explicação — estudante não sabe o que são esses modelos; "RCP (Representative Concentration Pathways)": Sigla expandida em inglês mas conceito não explicado — o que é um "caminho de co; "SSP (Shared Socioeconomic Pathways)": Mesmo problema — sigla expandida mas conceito opaco; "WRI Brasil" (seção PLAC): Sigla sem desdobramento; "CONDEPHAAT" (seção Patrimônio, esfera estadual): Sigla sem desdobramento
solos · prioridade 2
Reescrita sugerida pelo EDITOR: Solos e Hidrografia
EDITOR identificou 10 ponto(s) de melhoria didatica em 'campinas.solos-hidrografia': "Argissolos Vermelho-Amarelos" e "Cambissolos Háplicos" (seção Solos, primeiro parágrafo): Listados como classes majoritárias mas nenhum dos dois é explicado — apenas Lato; "calagem" (seção Solos, "exigem adubação e calagem"): Jargão agronômico sem explicação; "várzeas" (seção Solos): Termo sem explicação — já apontado em outras seções; "rochas básicas (basalto/diabásio)": "Básicas" no sentido geológico não é explicado; "ANA" (seção Hidrografia): Sigla sem desdobramento
vegetacao · prioridade 2
Reescrita sugerida pelo EDITOR: Vegetação, fauna e uso do solo em Campinas
EDITOR identificou 12 ponto(s) de melhoria didatica em 'campinas.vegetacao-fauna-uso-solo': "domínio morfoclimático do cerrado": "domínio morfoclimático" é jargão geográfico sem explicação — estudante não sabe; "floresta semidecídua": Termo botânico sem explicação — "semidecídua" não é palavra do cotidiano; "floresta higrófila": Jargão botânico sem explicação; "estágio avançado de sucessão": "Sucessão" no sentido ecológico não é conhecido por estudante de ensino médio; "251,77 hectares": Número de área sem ancora comparativa — estudante não intui se é grande ou peque
hidrografia · prioridade 2
Reescrita sugerida pelo EDITOR: Hidrografia atual de Campinas: bacias, córregos e abastecimento
EDITOR identificou 22 ponto(s) de melhoria didatica em 'campinas.hidrografia-atual': "165 km de extensão" (seção sub-bacia do Atibaia): Número sem ancora comparativa; "31 m³/s" (vazão do Atibaia): Número técnico sem ancora; "390 km² de área" (bacia do Quilombo) e "1.655 km²" (bacia do Capivari): Números de área sem ancora — estudante não intui escala; "águas pluviais e servidas" (seção Córregos urbanos): "servidas" é jargão — estudante não sabe que água servida = esgoto/água já usada; "atravém" (seção sub-bacia do Quilombo): Erro de grafia — correto é "atravessa"
clima · prioridade 2
Reescrita sugerida pelo EDITOR: Clima e mudanças climáticas em Campinas
EDITOR identificou 10 ponto(s) de melhoria didatica em 'campinas.clima-mudancas': "Clima atual": A classificação "Aw de Köppen" é citada sem explicação do que significa a letra ; "Clima atual": "Recordes: máxima de 39,0 °C (17/11/1985) e mínima de −1,5 °C (25/06/1918)" — a ; "Tendência de longo prazo": "Índice Padronizado de Precipitação" é jargão técnico citado sem qualquer explic; "Tendência de longo prazo": "118 anos de dados mensais de precipitação" — o número 118 é impressionante mas ; "Pressão climática atual": "vazão do Atibaia caiu bem abaixo da média histórica" — não há número nem compar
rios · prioridade 2
Reescrita sugerida pelo EDITOR: Rios Enterrados
EDITOR identificou 13 ponto(s) de melhoria didatica em 'campinas.rios-enterrados': "A geografia secreta do Ribeirão Anhumas": "desaguando dentro do parque industrial da Rhodia, em Paulínia" — Rhodia é citad; "O que está confirmado — Córrego Serafim": "Orosimbo Maia (1861–1939), político e proprietário rural que foi prefeito de Ca; "O sistema hidrográfico maior": O diagrama ASCII em bloco de código mistura entities que existem e não existem n; "O sistema hidrográfico maior": "vazão média de 31 m³/s" — número sem âncora; um estudante não sabe se 31 m³/s é; "O sistema hidrográfico maior": "percorre 165 km" e "percorre 54,7 km" — distâncias sem âncora; 165 km é quanto?
fauna · prioridade 2
Reescrita sugerida pelo EDITOR: Fauna notável de Campinas: endêmicas, extintas e comuns de destaque
EDITOR identificou 10 ponto(s) de melhoria didatica em 'campinas.fauna-notavel': Introdução, 1º parágrafo: "zona de transição entre cerrado e mata atlântica" é jargão biogeográfico sem ex; "O inventário da Mata de Santa Genebra", 2º parágrafo: "efeito de borda" usado sem explicação; "A onça-parda", 2º parágrafo: "sucessão territorial" é termo técnico sem explicação; "O lobo-guará na APA de Campinas", 1º parágrafo: "floresta estacional semidecidual" é classificação fitogeográfica sem explicação; "Corredores ecológicos e o futuro da fauna campineira", último parágrafo: "fluxo gênico" é termo de genética de populações sem explicação
ferrovias · prioridade 2
Reescrita sugerida pelo EDITOR: Ferrovias e industrialização de Campinas
EDITOR identificou 14 ponto(s) de melhoria didatica em 'campinas.ferrovias': Introdução: "nó ferroviário" é jargão técnico de transporte/logística sem explicação imediat; "Duas companhias, duas bitolas, um mesmo nó": "bitola larga (1,60 m)" e "bitola métrica (1,00 m)" são números técnicos sem ana; "Duas companhias, duas bitolas, um mesmo nó": "quebra de bitola" é termo técnico ferroviário sem explicação na mesma frase; "Duas companhias, duas bitolas, um mesmo nó": "transbordo" é jargão logístico sem explicação; "Duas companhias, duas bitolas, um mesmo nó": "42 km" de linhas desativadas sem escala de comparação
T0 · prioridade 4
scout.py::call_agent() pode extrair um payload incompleto em vez da resposta final completa
Achado ao tentar rodar SCOUT pra T14 (4 tentativas, 2026-07-29). Em pelo menos 1 caso confirmado, o log bruto da sessao OpenClaw (~/.openclaw/agents/deep_history/sessions/<id>.jsonl) mostra a resposta final do modelo completa e correta (stopReason='stop', todos os blocos ===FONTES===/===ENTIDADES===/===LACUNAS===/===AFIRMACOES===/===PROPRIEDADES===/===FIM=== presentes), mas o texto que scout.py::call_agent() extraiu do JSON do 'openclaw agent --json' e persistiu era muito mais curto (so ===FONTES=== completo, resto vazio) -- sugere que a extracao via result.payloads[0].text pega um payload incompleto/intermediario em vez do texto final, quando ha mais de um payload na resposta. Nao investiguei a fundo o formato exato do JSON (precisa de um dump bruto de 'openclaw agent --json' com esse caso reproduzido pra confirmar a hipotese e corrigir com seguranca -- ver comentario em call_agent() sobre o formato variar por versao). 2 das 4 tentativas de T14 tambem falharam com 'Agent couldn't generate a response' apos um evento de compactacao de contexto no meio do turno (achado separado, ver nota no HANDOFF) -- pode ser relacionado ou pode ser uma segunda causa distinta. Ate isso ser corrigido, rodar SCOUT em trilha nova exige inspecionar o resultado (fontes>0 mas entidades/afirmacoes=0 e sinal de alerta) e, se necessario, extrair a resposta final direto do .jsonl da sessao como workaround manual (feito pra este caso, mas o conteudo extraido tambem tinha problema de qualidade -- ver tarefa irma).
T7 · prioridade 4
Importar pesquisa de aves de rapina de Jundiaí (fauna-jundiai-pesquisa.md)
Existe pesquisa pronta e ja bem fundamentada em fauna-jundiai-pesquisa.md (raiz do repo, 679 linhas, fontes reais incl. inventario Consorcio PCJ 2023-24 com 251 especies de aves na Serra do Japi) sobre aves de rapina diurnas de Jundiai, T7. NAO pesquisar do zero -- rodar o SCOUT em modo que aproveite esse conteudo ja levantado como base (ex: passar o arquivo como contexto/--refine em vez de research fresh), escrever a secao jundiai.fauna-aves-rapina, e so depois mover/apagar o .md solto da raiz. Registrada apos achado de que essa pesquisa foi feita numa sessao que nao leu o AGENTS.md/HANDOFF do projeto (nao seguiu o fluxo formal).
T7 · prioridade 4
Fauna notavel de Campinas: endemicas, extintas na regiao, e comuns de destaque
Pedido explicito do Glaucus (2026-08-05): pesquisa nova de fauna para Campinas, simetrica ao que existe pra Jundiai (aves de rapina), cobrindo tres categorias: (1) especies endemicas da regiao, (2) especies que ocorriam na regiao e sao hoje extintas localmente (nao globalmente, extincao regional por perda de habitat/urbanizacao), (3) especies comuns hoje que valem destaque didatico. Usar packs/vegetacao-fauna.md como ponto de partida (ja cobre uso do solo/cobertura vegetal, mas nao fauna especie-a-especie) -- cuidado documentado no proprio pack de nao transplantar dado de outra regiao pra Campinas.
T11 · prioridade 5
Ferrovias e industrialização
Sugerido pelo Glaucus em conversa (bot Telegram) antes deste fix existir, nunca tinha sido registrado em lugar nenhum. Trilha ja definida em docs/PROJETO.md: companhias, ramais, estacoes, tecnologia, decadencia, o que resta. Fontes hoje: acervos ferroviarios online, Cia Paulista e Mogiana, fotos de acervo, estado atual das estacoes.
geral · prioridade 5
Revisao completa de todo o conteudo publicado -- achados e correcoes aplicadas
A pedido do Glaucus: reli as 18 secoes publicadas (todas as trilhas T1-T9,T12-T14 + geral), verificando duplicacao entre secoes, qualidade/consistencia de conteudo, e lacunas. Achados REAIS, corrigidos nesta sessao:
1) Corrupcao de texto na secao de Geologia (T1): caracteres cirilicos/vietnamitas misturados por erro de geracao nunca revisado ('temperaturas сверхiores', 'A_productividade', 'geologicascity quyetida') -- corrigido pra texto normal.
2) Arquivo orfao removido: clima-e-mudan-as-clim-ticas-em-campinas.md (slug mutilado, nao referenciado por nenhuma secao desde antes do fix de slugify de 2026-07-25).
3) Erro factual real: secao de Solos e Hidrografia (T5) atribuia a gestao do abastecimento a Sabesp -- errado, e a Sanasa (empresa municipal). Corrigido, com nota de correcao visivel.
4) Conflito real entre secoes: T5 dizia Rio Capivari fornece ~1% do abastecimento, T3 (Hidrografia atual) diz ~5% (99,31%/0,69% conforme fonte Sanasa/INTERACT-Bio) -- T5 simplificado pra apontar pra T3 em vez de reafirmar numero conflitante.
5) Conflito real entre secoes: minha propria secao nova T14 (Riscos) descrevia '6 piscinoes, R$559,63mi, inicio jul/2024' sem saber que T3 ja tinha 'oito reservatorios' nomeados (RP-1/RS-1, ja sao entidades reais no banco) com datas diferentes ('obras desde 2025'). Corrigido: T14 agora linka as entidades reais RP-1/RS-1 e declara a divergencia explicitamente em vez de escolher um numero arbitrariamente.
6) Bug real, visivel na pagina publicada: secao de Vegetacao, Fauna e Uso do Solo (T7) tinha 17 ocorrencias de marcadores de citacao nao resolvidos aparecendo como texto literal na pagina ('[[8e9140bf2e35c9c2]]' etc, incluindo '[[packs/vegetacao-fauna.md]]' -- auto-citacao do proprio pack aparecendo pro leitor). As fontes citadas existem de verdade no banco (Wikipedia, MapBiomas), mas zero afirmacoes foram registradas pra essa secao -- os hashes nunca foram convertidos pro sistema {{af:id}} do projeto. Removidos os marcadores brutos (texto limpo agora), adicionados 3 links de entidade que ja existiam sem uso. NAO fiz a re-estruturacao completa (registrar afirmacoes reais com fonte_id, dar a secao ledger/paineis 'como sabemos disso') -- isso e trabalho maior, registrado como pendente abaixo.
7) Ja registrado antes desta revisao: T1/T2 (Geologia/Relevo) re-explicam a mesma divisoria geologica Bacia do Parana/embasamento sem uma linkar a outra (tarefa campinas.geologia-relevo-explicam-mesma-divisoria-duas-vezes-2026-07-29) -- adicionado um link real da entidade bacia_parana + cross-link pra Relevo na secao de Geologia nesta revisao, mas o texto redundante em si nao foi reescrito (ambas tem conteudo proprio real).
8) CORRECAO de achado anterior: a tarefa deep-history.scout-confabula-entidade-ja-existente-2026-07-29 (fechada agora com correcao) superestimava o problema -- 'Serra das Cabras 1033m, Monte Urania' era dado REAL ja publicado, nao fabricado. So 'extensao_km: 150' era fabricado.
PENDENTE, nao feito nesta sessao (fora do escopo de tempo razoavel pra uma sessao): registrar afirmacoes/fontes formais pra secao de Vegetacao/Fauna (ponto 6); revisar T11 (nao existe ainda) e T13 mais a fundo quando forem escritas, considerando que ja tocam temas de T9 (cafe) e T14 (clima/Sirius); considerar reescrever o texto redundante de Bacia do Parana em uma das duas secoes (T1/T2) pra apontar pra outra em vez de re-derivar.
geral · prioridade 6
Geologia (T1) e Relevo (T2) re-explicam a mesma divisoria geologica em vez de uma linkar a outra
Achado a pedido do Glaucus, que suspeitava de repeticao entre secoes (2026-07-29). Confirmado: content/campinas/geologia-de-campinas-embasamento-cristalino-e-bacia-sedimentar.md e content/campinas/relevo-e-geomorfologia.md descrevem, cada um em prosa completa separada, o MESMO fato geologico central -- Campinas dividida entre Bacia do Parana (oeste) e embasamento cristalino/Planalto Atlantico (leste), os 4 dominios tectonicos de Amaral et al. 2019/2022, os diques de diabasio da Formacao Serra Geral. Nao e o bug original (pesquisa duplicada por acidente/colisao de id) -- as duas secoes usam parcialmente fontes diferentes pro angulo especifico delas (geologia cita Atlas Petrografico 2025 pra petrografia/idades; relevo cita Mendes 2002/Rondino 2005 pra mercado de agregados/uso do solo) -- mas o fato-base e re-derivado do zero em ambas em vez de uma linkar a outra. Achado concreto: a secao de Geologia menciona 'Bacia do Parana' varias vezes em negrito mas NUNCA linka a entidade campinas.bacia_parana (grep confirma 0 ocorrencias de 'entidade:campinas.bacia_parana' nesse arquivo); a secao de Relevo linka 1 vez. Correcao proposta: instrucao no SCOUT (build_prompt() ou agents/scout.md) pra, antes de escrever explicacao extensa de um fato fundamental compartilhado entre trilhas, checar se outra secao ja documenta isso em profundidade (via db.py --secoes + leitura do arquivo) e linkar sucintamente em vez de re-derivar por extenso -- mesmo mecanismo de link de entidade (entidade:id) ja usado no projeto, so que aplicado a nivel de fato/conceito compartilhado, nao so entidade nomeada. Nao e urgente reescrever o que ja existe (ambas as secoes sao substancialmente boas e tem conteudo proprio real, nao e so copia) -- o valor esta em evitar que isso se repita nas proximas trilhas (T14 cruza com T2/T3/T6, risco identico).
T1 · prioridade 7
5 afirmações de Geologia (embasamento) com fonte única, datações técnicas
CHECKER Parte 2 rodado 2026-07-27: afirmacao-3 (~626 Ma metamorfismo rochas oceânicas), -4 (740°C/12 kbar), -6 (afloramento ~500 m² Parque Ecológico), -10 (mapa geológico 1993 Fernandes et al.), -12 (datação LA-SF-ICPMS granitos Morungaba/Jaguariúna) — todas datações/medidas técnicas específicas de teses/artigos únicos (Amaral et al., Lagis/IG-Unicamp, Oliveira & Silva). Diferente do caso de Relevo (onde parte era Wikipédia mal classificada), aqui as fontes já são acadêmicas de verdade — o problema é genuinamente ausência de uma segunda fonte independente pra cada datação específica, não erro de classificação. Provavelmente fica fonte_unica por natureza (dado de pesquisa recente, pouco replicado ainda) — sinalizar honestamente com ⚠️ é o correto, não necessariamente 'resolver'.
geral · prioridade 8
Telemetria de token/custo zerada em sessões anteriores a ~25/jul
Achado ao medir R$/seção (item 1.13, 2026-07-28): logs de sessão do agente deep_history de geologia-recente e rios-enterrados tem usage={input:0,output:0,...} em 100% dos turnos, mesmo tendo produzido conteudo real publicado. Nao e bug de extracao (inspecionado o JSON bruto). Provavel gap de versao do OpenClaw ou de como NVIDIA NIM reportava uso nessas datas. Sem isso, nao da pra montar serie historica completa de custo -- so amostra parcial (3 de 5 secoes medidas, ver docs/MEDICAO-CUSTO-2026-07-28.md). Nao corrigivel retroativamente (dado nao existe). Prevenir: confirmar que a versao atual do OpenClaw reporta usage de forma confiavel pra todos os provedores usados na frota, nao so pros mais recentes.
T0 · prioridade 8
docs/PROJETO.md tem copia do schema desatualizada (falta territorios, propriedades, hipoteses, seed_projeto)
docs/PROJETO.md linha ~317 embute um trecho do schema.sql (tipos de fonte) que nao inclui seed_projeto (item 1B.4). O doc provavelmente ja estava desatualizado desde 1B.1/1B.2 (territorios, propriedades nao aparecem la). Nao bloqueia nada -- scripts nao leem PROJETO.md, e um doc de onboarding humano/agente -- mas vale sincronizar numa sessao de limpeza de docs.