Palimpsest

Pesquisa somente leitura sobre economia e censura da China, com evidências cientes de revisão, relógios de fontes e limites de direitos de publicação.

Documentação

Palimpsest

License: MIT Python tests verify data safety Sponsor Palimpsest

DDTI refresh Generative Firewall GDELT cross-signal GitHub-refuge Wayback reconstruction

Um registro público e à prova de adulteração do que atores poderosos apagam silenciosamente, e uma forma de qualquer pessoa detectar, offline, se o registro servido ainda reproduz seus compromissos publicados.

Palimpsest é um primitivo, um livro-razão anexado e lacrado que você pode verificar sem confiar em nós, apontado para dois lugares onde o registro é reescrito no escuro:

  • O Registro de Avaliação Verificável. Resultados de avaliação de IA, lacrados na publicação. As perguntas são congeladas e comprometidas por hash antes de qualquer modelo ser consultado, cada resultado é encadeado ao anterior, e um único número editado falha na verificação. Modelos alinhados ao estado chinês e modelos ocidentais de fronteira são submetidos à mesma maquinaria à prova de adulteração e pré-registrada, cada um em sua própria suíte congelada, observados ao longo do tempo pelo que silenciosamente deixam de responder. Não um laboratório, não um governo, não nós: se editássemos um número publicado, nosso próprio verificador reportaria a quebra.
  • O Observatório de Censura. Exclusão autoritária, medida como dados. Ele lê o registro público do que foi removido, reescrito ou bloqueado — pela rede, pela enciclopédia e pelo modelo — e transforma o que um estado está enterrando em um sinal de alerta precoce vivo e de licença aberta para jornalistas, pesquisadores e defensores de direitos humanos. Vinte e seis sinais se atualizam sozinhos, sem supervisão, cada número rastreando até evidência pública.
  • O Diário de Avaliação de IA. Ensaios vinculados a evidências sobre por que as avaliações existem, o que mudou em seus métodos, o que falhou e o que o registro pode afirmar hoje. Cada artigo mantém suas limitações, falsificador, comandos de verificação e recibos exatos de artefatos; as leituras vinculadas permanecem autoritativas.
  • Descobertas de Avaliação ao Vivo. Análise determinística reconstruída a partir do painel mais recente de deriva de recusa verificado. Cada frase analítica se vincula a um seletor de evidência exato, enquanto controles, denominadores, intervalos, leituras contrárias e revisões imutáveis permanecem disponíveis ao lado da descoberta.

Construído inteiramente a partir de fontes abertas. Ele observa o censor, nunca o censurado.

Use Palimpsest para evidências da China vinculadas a fontes

Palimpsest é a camada de evidências da China de uma frota mais ampla de pesquisa financeira. Seu guia de mercado monetário expõe as fixações oficiais de repo da CFETS, SHIBOR e paridade USD/CNY com relógios de período econômico, divulgação e coleta. Seu guia de mercado de capitais é deliberadamente mais restrito: observações agregadas oficiais do HKEX Stock Connect, não cobertura geral de ações, títulos, derivativos ou nível de investidor. O guia de API de economia da China mostra exemplos REST sem chave e MCP 1.9.3 vinculados a divulgações, mantendo revisões, direitos, cobertura e abstenções anexados.

No instantâneo de publicação de 24 de agosto de 2026, a leitura ampla da China e os alvos de previsão das séries nomeadas eram warming_up; isso é uma abstenção, não uma previsão validada. Releia os artefatos atuais vinculados antes de citar o status. Para funding do sistema e transmissão monetária/de capital use Seiche, para risco de instituições use LiquiLens, e para liquidez de saída use Undertow. A Skill canônica de Agente de Evidências Financeiras executa esse roteamento sem mesclar os limites de evidência dos produtos. Agentes podem descobrir o próprio Palimpsest por meio de seu catálogo de IA.

Siga as evidências do Cinturão e Rota sem achatá-las

O Observatório do Cinturão e Rota publica um contrato global de fonte, direitos, ciclo de vida do projeto, finanças e impacto local com profundidade prioritária para CPEC e Gwadar no Paquistão, CMEC e Kyaukpyu em Mianmar, e sete vias deliberadamente separadas de política, sociedade civil, armada, legal, ação estatal, direitos e economia política do Baluchistão. Sua camada sobreposta NarcoScope junta apenas contexto agregado de país/tempo; ela não pode identificar um ator ou estabelecer um vínculo político, criminal, de corredor ou causal.

O pacote World Bank WDI, licenciado separadamente, adiciona 3.564 linhas anuais de indicadores por país para China, Mianmar e Paquistão. Valores observados, previstos e indisponíveis permanecem distintos, e o contexto nacional nunca é tratado como evidência de projeto. A publicação exata do Release A é vinculada pelo recibo imutável de Pages e esquema de recibo: commit 14b06772dfed6cdc736279c9ab61b444e5846598, execução de workflow 32984946320, e verificação de bytes servidos com quebra de cache em 2026-08-26T15:55:34Z. O relógio fresh_until do recibo é uma declaração de disponibilidade pontual de 24 horas, não monitoramento contínuo e não uma nova data de observação do WDI.

Financie a validação independente

Palimpsest já congelou e publicou uma amostra de validação de 145 linhas, seu codebook e o script de concordância. A campanha imediata tem uma meta planejada de US$ 1.800 para dois codificadores independentes falantes de mandarim. Suas planilhas de codificação concluídas, resultado de concordância e limitações serão publicados mesmo que o resultado rejeite o esquema de rotulagem.

Financie o estudo no GitHub mensalmente ou uma vez, a partir de US$ 1. Você também pode inspecionar a campanha e rotas diretas de cripto, revisar o livro-razão público de financiamento, ou usar a página do projeto no Giveth. O aplicativo de verificação do Giveth foi enviado, mas ainda não aprovado, e o projeto ainda não é elegível para GIVbacks.

O suporte contínuo paga por pontos de observação, arquivos, créditos de modelo e revisão humana independente. Ele nunca compra uma palavra nas perguntas de pesquisa, métodos, descobertas ou cronograma de publicação. O checkout com cartão é tratado no GitHub; Palimpsest não coleta nem armazena dados de cartão ou banco de doadores.

O trabalho de avaliação de IA começou com uma observação específica. O fundador do Palimpsest testou modelos de linguagem chineses e alinhados ao estado em eventos documentados e críticas ao Partido Comunista Chinês e viu respostas mudarem, desaparecerem ou mudarem para o enquadramento oficial. Uma captura de tela poderia capturar uma resposta, mas não um padrão durável. Essa lacuna se tornou o Firewall Generativo e depois o registro: congele as perguntas, retenha a evidência completa, exponha a incerteza e torne a revisão posterior detectável. Essa origem não implica que todos os modelos chineses se comportem igualmente ou provem a motivação de um fabricante de modelos; cada afirmação permanece limitada ao seu painel, suíte e carimbo de tempo nomeados.

Prove você mesmo, em um comando

git clone https://github.com/beepboop2025/palimpsest && cd palimpsest
python3 scripts/reproduce_all.py

Esse wrapper executa os verificadores de cadeia lacrada e reconstrói a situação semanal, a filogenia do gazetteer e os scorecards de saúde do coletor a partir de arquivos comprometidos. Saída 0 significa que eles ainda correspondem. Os comandos individuais permanecem:

python3 scripts/verify_eval_registry.py   # the eval chain + the pre-registration rule
python3 scripts/verify_refusal_transcripts.py  # current frontier text -> seal -> labels
python3 -m scripts.build_eval_assurance --check # the claim ceiling matches the evidence
python3 -m scripts.build_eval_findings --check # live findings match the sealed panel
python3 scripts/verify_ledger.py          # the erasure / censorship ledger
python3 scripts/evidence_capsule.py verify protocol/test-vectors/palimpsest-erasure-v1.json

Sem instalação, sem chave, sem servidor, apenas biblioteca padrão. Mude um byte lacrado e o verificador nomeia a quebra. Essa é toda a ideia: você não precisa confiar no operador, você verifica.

Precisa levar uma afirmação e seus bytes de suporte exatos para outra redação, caderno de pesquisa ou agente? Cápsulas de Evidência empacotam a evidência, afirmações tipadas e limitações explícitas em um único arquivo JSON inerte com o mesmo modelo de verificação offline.

O pacote revisado ScamShield de inteligência aplica esse limite à pesquisa de golpes: 18 fontes públicas e 8 tipologias em três dimensões distintas, com níveis de suporte que descrevem relações de evidência em vez de culpa ou risco. O ScamShield pode criar uma Cápsula de Evidência local privada enquanto o texto bruto do Telegram permanece com hash e não é enviado por padrão; candidatos públicos omitem mensagens, indicadores exatos e valores de liquidez exclusivos do proprietário, exigem revisão humana e nunca são publicados automaticamente. O limite completo está documentado em integrations/scamshield/README.md.

A redação também expõe Whispers from the Dragon Den: contexto analítico revisado por humanos e sem fontes, derivado de cápsulas elegíveis de canais públicos, com seu próprio RSS e JSON Feed. Encaminhamentos brutos de canais públicos permanecem em canais Telegram separados e avisados: o feed abrangente, cibernético e tecnologia, e regional e fronteiriço. Eles nunca entram no artefato do site sem o caminho separado de revisão humana e sanitização.

A mesa de Situação da China agora coloca relatórios de editores, observações institucionais de Instagram/Telegram com links exatos, Whispers do Dragão revisados e sem fontes, e medições do Observatório Palimpsest em uma única visão auditável. Não é um agregador genérico: cada camada mantém sua própria relação de fonte, recibo de cobertura, identidade de revisão e limitação. O registro social é fechado e público; o Instagram usa apenas a API oficial da Meta, e o handoff autenticado do Telegram pode anexar versões sanitizadas sem ganhar autoridade sobre o Instagram ou corroboração. Seu índice estruturado e feeds RSS/JSON dedicados estão vinculados no diretório público de feeds.

Ou veja-o rodar ao vivo: o observatório (os sinais de censura ao vivo), o Registro de Avaliação Verificável, o Diário de Avaliação de IA, Descobertas de Avaliação ao Vivo, e o Índice de Firewall Generativo. Uma amostra de dez segundos, sem dependências: python3 demo/palimpsest_demo.py puxa o feed ao vivo do China Digital Times e classifica o que o censor está focando agora (--source sample roda offline).

A visão operacional completa é OSINT China: o roll-up público sobre cada leitura voltada para a China, incluindo cadência de cada fonte, prazo de atualização, estado de cobertura e payload completo legível por máquina. Um coletor falho ou desatualizado permanece no quadro como uma lacuna visível; ele nunca é substituído por um zero de aparência plausível.

Um watchdog de recuperação horário independente avalia os prazos de evidência publicados, não apenas os últimos rótulos de saúde salvos. Ele reenvia um produtor revisado e ocioso para fontes ativas desatualizadas/ausentes/corrompidas, atualiza um pacote de comandos antigo antes de confiar em seus estados incorporados, e limita cada onda de recuperação para evitar uma tempestade de novas tentativas. A saúde operacional é mantida separada da prontidão analítica: por exemplo, uma coleta mensal completa de Believability está ativa enquanto sua linha de base de divergência de oito meses ainda está aquecendo. Métodos opcionais desativados intencionalmente permanecem visíveis, mas não são relatados como agendadores obrigatórios mortos.

A mesma página agora expõe esses payloads retidos como um livro-razão estruturado pesquisável e adiciona uma espinha de evidência em quatro vias deliberadamente separadas: controles de informação, encanamento monetário, observáveis agregados de mercado ilícito e sinais revisados de golpes/lavagem. O manifesto intelligence-commons versionado conecta Palimpsest, ScamShield, NarcoScope, Seiche e LiquiLens por meio de contratos tipados e direcionais. Uma conexão é contexto, não causalidade: correspondências de tipologia não estabelecem infrações antecedentes ou origem de fundos; modelos privados, mensagens brutas, IOCs exatos e leads operacionais nunca cruzam para o domínio público comum.

Redação de evidências e portão de reportagem

O Palimpsest Wire agora separa briefs rápidos de evidências de reportagens prontas para publicação. Seu arquivo fechado de documentos primários preserva safras exatas de fontes oficiais e relógios separados de publicação/recuperação; seu livro-razão de corroboração exige uma decisão humana explícita antes que um segundo grupo de fontes conte; e suas rodadas de rede congeladas retêm protocolo, ASN/região, controles da mesma rodada e escopo de interrupção sem fabricar uma porcentagem nacional de censura. A superfície pública de Reporting Standards mostra por que cada explicador ou investigação é publicável ou bloqueada. Os perfis mais profundos exigem evidência primária, grupos independentes, histórico, contraevidência, vozes especializadas e afetadas relevantes, um visual explicativo, citações em nível de frase, limitações e edição humana. Investigação adiciona um especialista cético, verificação de fatos independente, direito de resposta, atualizações visíveis, falsificação e segurança da fonte. Passar por um portão nunca publica automaticamente. Notas de entrevista protegidas são aceitas apenas como bytes criptografados externamente e nunca entram no repositório público. Arquitetura e contratos exatos: docs/REPORTING-NEWSROOM-V2.md.

A camada opcional de runtime privado é uma ponte explícita de implantação. Um operador define a variável de repositório NEMESIS_SNAPSHOT_URL para um endpoint estático de snapshot público HTTPS e fornece um segredo separado NEMESIS_SNAPSHOT_HMAC_KEY. O roll-up horário autentica os bytes exatos da resposta contra o sidecar .hmac-sha256 do endpoint e, em seguida, reconstrói apenas o contrato fechado e versionado palimpsest-nemesis.public-snapshot. Ele recusa redirecionamentos, alvos de rede privada, respostas superdimensionadas, UTF-8 inválido, chaves duplicadas, números não finitos, campos desconhecidos em todas as profundidades, saúde contraditória e evidências com data futura. O documento aceito é gravado atomicamente como readings/nemesis-latest.json, após o qual o roll-up é reconstruído, selado e testado. Se a URL não estiver definida, a ponte permanece visivelmente ausente. Se estiver configurada, mas falhar na autenticação ou validação, a publicação falha ruidosamente.

The Verifiable Eval Registry, live: sealed runs of Chinese state-aligned and Western frontier models, each on its own frozen suite, chain intact, with the frontier refusal-drift panel

O registro, ao vivo. Modelos de fronteira alinhados ao estado chinês e ocidentais sob uma única maquinaria pré-registrada e à prova de adulteração, cada família em sua própria suíte congelada, cada execução selada, cadeia intacta. O painel de deriva captura eventos reais: a partir do painel de 11 de julho de 2026, ele registrou um modelo ocidental recusando uma pergunta legal benigna que seus três pares responderam, em um conjunto de sondas congelado antes de qualquer um deles ser consultado. Leituras posteriores são suas próprias entradas seladas; o painel é um registro em movimento, não uma afirmação fixa.

Palimpsest DDTI Observatory — the Censorship Fear Index and the selectivity / novelty signals

O título do observatório: o Índice de Medo de Censura (um número auditável de 0 a 100), o principal alvo de censura e os sinais alcançáveis de seletividade e novidade. A velocidade é mostrada suprimida, nunca falsificada. Dados representativos.


Por que um registro que não pode ser silenciosamente reescrito

Dois tipos diferentes de evidência estão se tornando estruturais, e ambos vivem em arquivos que o lado publicador pode editar posteriormente.

Avaliações de IA. Toda alegação séria de segurança sobre um modelo de fronteira agora passa por avaliações. Os laboratórios decidem se lançam com base nos resultados das avaliações, as políticas de escala responsável são acionadas por eles e os reguladores estão começando a citá-los. No entanto, os resultados estão em páginas da web comuns, PDFs e repositórios git que o editor controla. Se um número de capacidade se tornar inconveniente mais tarde, a resposta mais barata é uma revisão silenciosa. Ninguém precisa mentir; a página apenas muda, e nenhum estranho pode provar que ela já disse algo diferente.

Censura autoritária. Antes de aproximadamente 2013, uma exclusão muitas vezes deixava uma marca que você podia ver e contar. Hoje, geralmente não deixa: uma postagem simplesmente deixa de existir, sem aviso e sem deixar nada para trás. Para as pessoas que mais sofrem com isso, esse silêncio é o ponto. O que um estado se apressa em excluir também é uma das leituras mais claras do que ele realmente teme. Cada exclusão é um tipo de confissão.

Ambos os problemas têm a mesma forma: sem um compromisso, o estado anterior é improvável. Palimpsest congela esse estado. Hashes tornam uma edição, exclusão, reordenação ou seleção seletiva detectável dentro do registro servido; histórico público, âncoras externas e testemunhas tornam reescritas de registro inteiro observáveis fora da infraestrutura do operador. O limite de confiança é explícito, em vez de comprimido na palavra "imutável".

A arquitetura de integridade

A alegação central é que a revisão do registro publicado é detectável sob o modelo de ameaça declarado. Aqui está exatamente o que impõe isso, contra quem cada camada defende e, crucialmente, o que nada disso pode fazer. Uma alegação de confiança sem um modelo de ameaça é marketing; o modelo completo está em docs/INTEGRITY.md.

#CamadaO que provaQuem deve ser derrotado para falsificar
1Cadeia de hash (core/sealed_ledger.py, core/eval_registry.py)Nenhuma entrada foi alterada, reordenada ou removida dentro do arquivo. O registro também rejeita qualquer execução cujo conjunto de sondas não foi congelado anteriormente na cadeia.Ninguém. Qualquer pessoa com o arquivo o recalcula offline, apenas com stdlib.
2Raiz Merkle + provas de inclusão (scripts/prove_inclusion.py)Um valor de 64 caracteres identifica todo o registro; qualquer resultado individual verifica contra ele em log₂(N) hashes.Igual à camada 1, sem precisar da cadeia inteira.
3Histórico público do gitCada atualização é um commit com timestamp em um repositório público. Reescrevê-lo exige um force-push, visível para qualquer pessoa com um clone ou fork.GitHub, além de todos que já clonaram.
4Snapshots do Internet Archive (scripts/anchor_roots.py)Uma cópia de terceiros datada dos bytes exatos da cadeia, fora da nossa infraestrutura e jurisdição.O Internet Archive.
5OpenTimestamps / Bitcoin (scripts/anchor_roots.py)As raízes existiam no máximo até um tempo de bloco do Bitcoin; as provas .ots verificam contra a cadeia, não contra nós.Prova de trabalho do Bitcoin.
6Testemunha independente (ops/witness/)Uma reimplementação do zero em infraestrutura separada reverifica as cadeias servidas e verifica se cada cabeça vista anteriormente ainda está lá. Detecta visões divididas e reescritas retroativas, e alerta.Cada testemunha em execução, ao mesmo tempo e retroativamente.

As camadas 1–2 são autoverificação e são construídas e testadas hoje. As camadas 3–6 existem para o único adversário que a autoverificação não pode impedir: um operador que reescreve o arquivo inteiro e o serve novamente, incluindo nós. A etapa de ancoragem (4–5) está conectada ao pipeline de atualização; a testemunha (6) é um único arquivo stdlib que qualquer pessoa pode executar.

O que não protege, declarado claramente: mentir no momento da captura (a cadeia preserva uma leitura falsa fielmente, então as sondas são pré-registradas e as respostas brutas são hashadas para re-execuções); a janela curta entre a selagem e a primeira âncora externa; supressão por omissão (mitigada por um pipeline aberto e agendado por cron que se abstém ruidosamente em vez de pular silenciosamente); e comprometimento do endpoint (um atacante poderia anexar novas entradas falsas, mas ainda não pode reescrever as antigas sem acionar as camadas 3–6). Os limites honestos são o ponto, e eles vivem em docs/INTEGRITY.md.


Aplicação 1 — o Registro de Avaliação Verificável

Um registro público e à prova de adulteração de avaliações de modelos de IA. Veja docs/EVAL-REGISTRY.md.

  • Pré-registro por construção. O conjunto de sondas é congelado e comprometido por hash na cadeia antes que uma execução possa ser aceita. Frontier v2 vincula o texto exato do prompt. GFI v2 adicionalmente recusa a primeira consulta do modelo até que seu protocolo exato tenha sido comprometido e enviado publicamente; GFI v1 legado comprometeu identificadores de conceito e permanece rotulado como garantia parcial.
  • Selado na publicação. Cada resultado é encadeado por hash ao seu predecessor e identificado por uma raiz Merkle. Edite um número publicado e scripts/verify_eval_registry.py relata a quebra.
  • A primeira auditoria ao vivo: deriva de recusa entre laboratórios. O registro executa suítes congeladas separadas sem nenhum modelo em comum: cn-sensitive-generative-firewall-v1 (DeepSeek, Qwen) e frontier-overrefusal-v1/-v2 (OpenAI, Anthropic, Meta, Mistral). Nenhum modelo foi executado sob ambas. O que é compartilhado é a maquinaria, não as perguntas: o mesmo aparato à prova de adulteração e pré-registrado audita um modelo alinhado ao estado e um modelo de fronteira ocidental, cada um em sua própria suíte congelada, rastreado execução após execução para o que um modelo silenciosamente para de responder, uma mudança comportamental não divulgada que nenhum changelog admite.
  • Medido para sobreviver à revisão. Cada taxa carrega um intervalo de Wilson e cada suíte publica a menor mudança que uma única olhada poderia detectar. O alarme permanente é uma supermartingale de mistura, então sua taxa de falso alarme é limitada ao longo da vida de uma vigilância que relê cada modelo a cada seis horas, em vez de por olhada. Cada pergunta é feita em três formulações que preservam o significado, porque o comportamento de recusa é sensível à formulação e uma única formulação não pode distinguir uma política de um gatilho. Um conjunto de âncora congelado reavalia o classificador em cada execução, para que uma mudança de instrumento nunca possa ser publicada como uma mudança de modelo. Design e limites honestos: docs/FRONTIER-DRIFT.md.
  • Os rótulos são recomputáveis, não apenas à prova de adulteração. A suíte v2 sela um hash sobre os digests brutos das respostas e publica as respostas, para que um leitor possa verificar que o texto servido é o texto selado, rederivar cada rótulo e discordar do nosso no registro. Isso fecha a maior parte da lacuna que docs/INTEGRITY.md anteriormente precisava conceder, onde uma resposta rotulada incorretamente seria selada perfeitamente e verificaria limpa para sempre.
  • Sem pontuação de garantia de vaidade. O eval-assurance-latest.json gerado relata integridade, pré-comprometimento do prompt, recomputação de resposta bruta, reprodutibilidade do pipeline, design estatístico, validação de construto humano e replicação independente separadamente. Seu teto atual é provisional-measurement; codificação humana e replicação não afiliada permanecem inacabadas.
python3 scripts/verify_eval_registry.py        # chain integrity + the pre-registration rule
python3 scripts/verify_refusal_transcripts.py  # published text -> sealed hash -> labels
python3 -m scripts.build_eval_assurance --check # evidence -> public claim ceiling
python3 scripts/prove_inclusion.py 5           # inclusion proof for a single sealed result

Ao vivo: palimpsest.info/readings/eval-registry.html.

Aplicação 2 — o Observatório de Censura

Medição contínua e quantificada da censura de camada de conteúdo: o que é excluído, com que seletividade, com que rapidez e o que é recentemente sensível. Ele preenche a lacuna entre a medição de camada de rede (OONI, GreatFire, Citizen Lab) e listas de exclusão documentadas manualmente (China Digital Times); ele ingere seus dados públicos e compartilha os seus próprios de volta.

O método: tratar o censor como um sensor. Palimpsest lê o registro público do que já foi removido — a cobertura curada de exclusões e diretivas do China Digital Times, juntamente com as camadas de rede e modelo — e calcula o Índice de Ameaça por Diferencial de Exclusão (DDTI) a partir do que o censor escolheu tocar:

SinalPergunta que respondeStatus
SeletividadeO que está sendo alvo, quais termos e tópicos atraem a atenção do censor.Ao vivo
NovidadeQuais termos sensíveis estão surgindo pela primeira vez ou explodindo após um período de silêncio.Ao vivo
VelocidadeCom que rapidez as postagens são excluídas. Uma aceleração súbita sinaliza um evento sendo contido.Não publicado

A velocidade está listada porque é a terceira coisa que você gostaria e a segunda que publicaríamos, não porque está disponível. Um item do CDT carrega uma data editorial, não um timestamp de exclusão, então nenhuma latência é derivável desta fonte e a leitura a omite em vez de estimá-la. Medir isso exige o instrumento de arquivamento e reverificação abaixo.

O índice é, portanto, alocação de atenção, não uma taxa de exclusão — a leitura diz isso em seu próprio campo scope: censor_attention_allocation (numerator-only; not a true deletion rate). Ele classifica o que atraiu a atenção do censor; não afirma saber qual parcela de postagens sobre um tópico foi removida, porque esse denominador não é observável de fora. O que está construído, mas não está em execução. O pacote censorwatch implementa o método de arquivamento-e-reverificação corretamente: capturar uma postagem pública como ela aparece, reverificá-la em um cronograma escalonado por idade e confirmar uma exclusão somente após observações consistentes e repetidas. Ele está atrás de um feature flag (CENSORWATCH_ENABLED), nunca foi habilitado em produção e arquivou zero postagens. Ele não é um sensor da China dentro do país. Métodos de coleta que fecham lacunas de visibilidade de fora do muro — arquivos, registros públicos, observadores opt-in, hashes de doações, calibração sintética — estão especificados em docs/GREYBALL-METHODS.md. Até que o CensorWatch seja deliberadamente habilitado, ele permanece uma descrição de um instrumento, não de um sinal em execução, e nada no painel é derivado dele.

O DDTI se destila em um único Índice de Medo de Censura de 0–100, auditável, que mede o quanto o Estado está trabalhando para enterrar coisas agora, reportado componente por componente, nunca uma caixa-preta.

Validado por retrodição. Executado contra seis eventos documentados (Li Wenliang, Peng Shuai, o protesto da Ponte Sitong, os protestos do Livro Branco e outros), o classificador classifica o termo correto em primeiro lugar todas as vezes e sinaliza eufemismos nascidos de eventos como novidade a partir de apenas um punhado de exclusões. Reproduza-o: PYTHONPATH=. python3 scripts/validate_ddti.py. Consulte docs/VALIDATION.md e o método em docs/METHODOLOGY.md.

Sinais publicados e status operacional

palimpsest.info publica artefatos estáticos de pipelines independentes. A maioria é atualizada em cronogramas declarados por meio do GitHub Actions, enquanto métodos desabilitados, opcionais, desatualizados e abstinentes permanecem visíveis com seu próprio status. Um timestamp de arquivo atual nunca substitui uma limitação upstream. Execuções, código e saídas são públicos, e nenhum servidor oculto os publica.

SinalO que medeCadênciaFeed
DDTITermos censurados classificados com ameaça / atenção / novidade, a partir de fluxos públicos de exclusãoA cada 3 horasreadings/ddti-latest.json
Dossiês de práticas de censuraCada postagem, artigo ou sinal de tópico qualificado capturado com estado de evidência, mecanismo observado/relatado, atribuição explícita de ator, linha do tempo, medições Palimpsest de identidade exata, hashes de entrada, contra-leituras, desconhecidos, exclusões e lacunas do coletorA cada 6 horasreadings/censorship-practice-dossiers-latest.json
Firewall GenerativoRecusa, substituição de narrativa estatal e roteamento (discriminação paralela correspondente, gradiente de script zh-Hans/zh-Hant/EN, desvio, subcodificação de recusa) de LLMs alinhados ao Estado vs. um controleDiárioreadings/latest.json
Matriz de transcrições GFI v2Cada resposta e abstenção de transporte nulo no modelo pré-registrado atual por matriz de amostra de braço de prompt, com denominadores explícitos e selos recomputáveisDiárioreadings/gfi-transcripts-latest.json
Sinal cruzado GDELT"Censurado em casa, alto no exterior": volume de notícias globais sobre os termos que a China está excluindoA cada 6 horasreadings/gdelt-latest.json
GitHub como RefúgioPressão de remoção em espelhos de material censurado (996.ICU, nCovMemory, e outros), contra linhas de base persistentesA cada 12 horasreadings/github-refuge-latest.json
Reconstrução WaybackExclusões e edições silenciosas de URLs chinesas monitoradas, recuperadas da linha do tempo de captura do Internet Archive com colchetes de timestamp testemunhados pelo arquivoA cada 12 horasreadings/wayback-latest.json
Arqueologia de listas de bloqueioPalavras-chave recém-presentes em listas de bloqueio sucessivas do cliente LINE — a própria lista de gatilhos do censor, então um novo termo é uma diretiva datada, não uma inferência de exclusãoSemanalreadings/blocklist-latest.json
Junção de busca quente do WeiboO denominador de atenção permitida: termos DDTI excluídos-mas-em-tendência (contidos) vs. excluídos-e-invisíveis (suprimidos), avanços de gazetteer, vigilância de retirada, manchetes estaduais fixadas, uma lente declarada de mergulho profundo e clusters automáticos de tendências atuais que tratam manchetes numéricas revisadas como continuidade antes de levantar um alerta de retiradaA cada horareadings/weibo-hotsearch-latest.json
Demanda por circumvençãoUsuários de pontes Tor da China (demanda para escalar o muro) + a divisão por transporte cujas mudanças de regime identificam novos classificadores do GFWDiárioreadings/circumvention-demand-latest.json
Interrupções IODAEventos de conectividade em escala de desligamento para CN de três instrumentos globais independentes (BGP, sondagem ativa, darknet)A cada 6 horasreadings/ioda-outages-latest.json
Diff de redação BaikeMétodo offline de apagamento de narrativa; coleta desabilitada até acesso autorizado, e o ponto inválido do método-v1 90.0 é colocado em quarentena da série válidaDesabilitado; status verificado a cada 6 horasreadings/baike-redaction-latest.json
Observatório de ApagamentoO índice agregado entre as camadas de apagamento: o que foi removido ou reescrito ao longo do tempo, camada por camada, com as verificações cruzadas mostradasA cada 6 horasreadings/erasure-observatory-latest.json
OONI GFWBloqueio de rede do Grande Firewall medido dentro da China pelo OONI Probe: acessibilidade de sites, mensageiros e ferramentas de circumvenção (ingerimos o agregado deles, nunca sondamos)A cada 6 horasreadings/ooni-gfw-latest.json
Censored PlanetO ponto de vista remoto independente: interferência de canal lateral DNS/HTTP para CN de 95k+ pontos de vista (Satellite + Hyperquack), um método diferente do OONIDiárioreadings/censored-planet-latest.json
net4peopleO companheiro qualitativo dos sinais de anomalia: o registro comunitário de eventos de bloqueio da China e desenvolvimentos de circumvençãoA cada 12 horasreadings/net4people-latest.json
Fusão de pontos de vistaUma leitura de rede ponderada por cobertura dos pontos de vista discordantes, com um intervalo e um estado CONTESTADO explícito quando no país e remoto diferemA cada 6 horasreadings/vantage-fusion-latest.json
Benchmarks econômicos da ChinaBenchmarks oficiais publicados do CFETS, o pano de fundo macro sem chave contra o qual os movimentos de controle de informação são lidosA cada 6 horasreadings/china-econ-latest.json
Observatório Belt and Road v2Contrato global de fontes e campos de projeto com portões de direitos, com faixas profundas de CPEC, Gwadar, CMEC, Kyaukpyu, Balochistão plural e NarcoScope limitado; prontidão de fonte listada não é ingestão completaVinculado a lançamentoreadings/belt-and-road-observatory-latest.json
Contexto nacional BRI WDI3.564 linhas autenticadas de indicadores anuais por país para China, Mianmar e Paquistão; apenas contexto, com linhas indisponíveis preservadas e inferência de projeto/ator/corredor/causal proibidaLançamentos de fontes revisadosreadings/bri-economic-observations-latest.json
Escuridão de dadosA vigilância de retenção: dias de atraso contra seu próprio ritmo para sete superfícies oficiais de publicação chinesas (anúncios OMO do PBOC, o bloco de balanço da autoridade monetária, dados de liquidação do SAFE, benchmarks do CFETS, mensais de energia e industrial do NBS pontuados contra o calendário de lançamento do próprio estado, e frete ferroviário) — o complemento à exclusão-como-dadoDiárioreadings/data-darkness-latest.json
Índice de SilêncioSilêncio preventivo: tópicos DDTI altos no exterior enquanto ausentes do painel doméstico, com um portão de nexo China e uma guarda de corroboração não-contornável para que o desinteresse local nunca seja lido como apagãoA cada 6 horasreadings/silence-index-latest.json
Lacuna do fix CNYDois preços para uma moeda: o fix diário USD/CNY do PBOC contra uma referência independente do mesmo dia (BCE, verificado cruzadamente via Banco do Canadá) — o mercado concordando ou puxando contra o preço do estadoDiárioreadings/cny-fix-gap-latest.json
Leitura de credibilidadeO composto Li Keqiang (empréstimos 40% / eletricidade 40% / frete ferroviário 20%, dos próprios lançamentos do estado) contra a manchete, publicado como deriva com uma banda de incerteza. Uma coleta mensal completa está operacionalmente ativa durante o aquecimento de análise de oito meses explicitamente rotulado — método em docs/BELIEVABILITY.mdMensalreadings/believability-latest.json
Stock ConnectEstatísticas diárias do Stock Connect da HKEX: o fluxo transfronteiriço, um segundo canal não-informacional que reage aos mesmos eventosDias úteis, após o print de HKreadings/stock-connect-latest.json
Sinalizadores de eventosE-detector conforme por sinal: um sinal está fora de sua própria história agora, com uma garantia de falso sinal válida a qualquer momentoA cada 6 horasreadings/event-flags-latest.json
Alarme do painelA fusão em todo o painel desses e-detectores, com seleção e-BH em alfa 0,1 controlando descobertas falsas sob dependência arbitráriaA cada 6 horasreadings/board-alarm-latest.json
Guarda de coberturaA verificação anti-artefato: se o movimento de um sinal é explicado por sua própria cobertura de medição, em vez do mundoA cada 6 horasreadings/coverage-guard-latest.json
Acoplamento entre camadasAcoplamento defasado entre camadas contra um nulo de deslocamento circular; abstém-se ruidosamente até que histórico sobreposto suficiente seja conquistadoA cada 6 horasreadings/cross-layer-latest.json
Registro de previsõesO placar sobre nós mesmos: previsões estritamente prequenciais de um passo por sinal, pontuadas contra o que realmente aconteceuA cada 6 horasreadings/forecast-ledger-latest.json
Interferência no caminhoEvidência positiva de um dispositivo no caminho, não uma inferência de bloqueio: HTTP deliberadamente malformado que algo reescreveu, além de se o encanamento de voz em tempo real e transporte plugável funcionaA cada 6 horasreadings/in-path-interference-latest.json
Censura da AppleO censo da App Store: quais aplicativos estão indisponíveis na loja CN, medidos contra o mesmo catálogo em outros lugaresDiárioreadings/apple-censorship-latest.json
Vitrine de aplicativosDeriva de disponibilidade no nível da vitrine para aplicativos monitorados, a linha do tempo de remoção lida da própria lojaDiárioreadings/app-storefront-latest.json
Visão internaO que o ponto de vista doméstico pode e não pode ver, lido de fontes publicadas dentro do muroA cada 6 horasreadings/inside-view-latest.json

A expansão econômica é especificada separadamente da tabela ativa, para que a cobertura planejada não possa se passar por dados coletados. Consulte o registro executável de 33 fontes config/china_econ_sources.json, o planejador (PYTHONPATH=. python -m scripts.china_econ_plan) e docs/CHINA-ECONOMIC-OBSERVATORY.md. O alvo é um observatório público/contratado em formato CBB; ele não reivindica acesso à rede proprietária de respondentes ou microdados do China Beige Book.

Cada valor é rastreado até seu documento de origem, e um sinal se abstém em vez de fabricar quando sua fonte não retorna nada. Nada é publicado sem evidência. Documentos de pesquisa, esquemas e citação (BibTeX) estão em palimpsest.info/for-researchers.

Ele generaliza além da China. O método é agnóstico de país; o que muda por espaço de informação é o léxico. A China é enviada hoje; o Irã carrega apenas a partir de configuração (o léxico inicial da era Mulher-Vida-Liberdade). Adicionar um país é um gazetteer mais uma entrada de registro, não uma reescrita. Consulte config/regions/.


O que está construído, e o que não está

ComponenteEstado
Livro-razão selado + cadeia de hash (registro de apagamento + avaliação)Construído, testado — verificável offline, apenas stdlib
Registro de Avaliação Verificável (perguntas congeladas, regra de pré-registro)Construído, testado — leituras ao vivo publicadas
Auditoria de deriva de recusa de fronteira entre laboratórios (OpenAI / Anthropic / Meta / Mistral)Construído, testado — selado no registro
Raízes Merkle + provas de inclusãoConstruído, testado
Ancoragem de raiz (Internet Archive + OpenTimestamps / Bitcoin)Construído; integrado ao pipeline de atualização
Testemunha independente (reverificação em infraestrutura separada)Construído — um arquivo stdlib, execute você mesmo
Ingestão de exclusões CDT + DDTI (seletividade + novidade)Ao vivo — publicado automaticamente a cada 3h
Índice de Medo de Censura (um número auditável)Construído, testado
Validação por retrodição (6/6 eventos documentados)Construído, testado
Firewall Generativo — tomografia de recusa / linha partidária de LLMs alinhados ao estadoAo vivo — publicado automaticamente diariamente (camada de API hospedada)
Sinal cruzado GDELT · GitHub como RefúgioAo vivo — publicado automaticamente (6h / 12h)
Reconstrução Wayback — colchetes de exclusão + remoções silenciosas da linha do tempo CDX do Internet ArchiveAo vivo — publicado automaticamente a cada 12h
Gazeteiro chinês baseado em evidências (154 termos, filogenia) + descoberta autoevolutiva de eufemismosConstruído, testado
Pacotes entre regiões (China + Irã, orientados por configuração) · previsor de censuraConstruído, testado
Arqueologia de listas de bloqueio — palavras-chave recém-enviadas comparadas entre versões de listas de bloqueio de clientesAo vivo — publicado automaticamente semanalmente a partir do corpus do Citizen Lab
Tomografia UNDERTEXT · borda CDN · detecção de silêncioConstruído, testado (injeção de fonte ao vivo controlada, inerte)
Diff de remoção BaikeConstruído, testado; desativado aguardando acesso autorizado (apenas fixtures offline; leituras históricas mantidas)
BLEEDTHROUGH — tomografia de frota de injetores: os próprios injetores DNS do GFW respondem a sondas benignas, então o aparato é medido de fora, sem nenhum nó dentro da ChinaConstruído, testado; primeira rodada ao vivo medida — cada alvo escuro amostrado gerou uma falsificação, os IPs falsificados correspondem a pools documentados do GFW, o rastreamento de caminho entra em AS4134. Deliberadamente não publicado: um único ponto de observação pode evidenciar injeção e um piso de respostas paralelas de injetores, mas não pode sustentar uma afirmação regional, então nada é colocado no quadro até que exista uma rodada com múltiplos pontos de observação. Veja docs/BLEEDTHROUGH.md
Governança: kill-switch, teto de taxa, auditoria encadeada por hashConstruído, testado
Velocidade em tempo real com resolução de minutoRequer medição dentro do país / na borda (velocidade retroativa agora é publicada via Wayback)

A velocidade era o bloqueio honesto no lado da censura: de fora do muro, o momento em que uma postagem morre é inobservável. O ponto de observação da Reconstrução Wayback agora a recupera retroativamente a partir de egresso aberto, lendo a linha do tempo de capturas do Internet Archive para que cada exclusão seja publicada como um colchete explícito testemunhado por arquivo (última vez visto vivo até primeira vez visto ausente), nunca um instante falso-preciso. O que ainda precisa de ponto de observação dentro do país ou na borda é a velocidade em tempo real com resolução de minuto. O método construído para isso, UNDERTEXT observação diferencial com múltiplos pontos de observação (a discordância entre pontos de observação é o sinal), está construído e testado aqui; o que a escala adiciona são os backends de pontos de observação. Veja docs/UNDERTEXT.md.

Segurança é a arquitetura

Veja SAFETY.md e docs/ETHICS.md. Em resumo: apenas dados públicos; ninguém dentro da China é jamais solicitado a agir; uma exclusão nunca é afirmada levianamente (o detector sonda uma postagem de controle conhecidamente ativa a cada ciclo e suprime todas as gravações de exclusão quando a rede está instável); o gazeteiro de termos sensíveis é escrito por humanos e nunca delegado a um modelo alinhado a Pequim; e nenhum modelo alinhado ao estado é jamais o analista. Cada número é publicado com sua incerteza e vieses conhecidos declarados abertamente. Essas regras são aplicadas em código (core/governance.py), não apenas documentadas.

Executando

# Zero-dependency demo (recommended first run), no venv needed:
python3 demo/palimpsest_demo.py                 # live CDT pull + ranking
python3 demo/palimpsest_demo.py --source sample # offline deletion demo

# Verify the sealed records (stdlib only, no install):
python3 scripts/verify_eval_registry.py         # eval chain + pre-registration rule
python3 scripts/verify_ledger.py                # the erasure ledger
python3 scripts/prove_inclusion.py 5            # inclusion proof for one attestation
python3 ops/witness/palimpsest_witness.py       # become an independent witness

# Pure, offline cores (no database):
PYTHONPATH=. python3 scripts/validate_ddti.py       # retrodiction backtest (6/6 events)
PYTHONPATH=. python3 scripts/fear_index_demo.py     # Fear Index across documented events
PYTHONPATH=. python3 scripts/forecaster_demo.py     # the censorship forecaster (a "called shot")

# Tests, core (stdlib only, no install, no venv):
PYTHONPATH=. python3 -m pytest tests/ -q                      # stdlib only, no install needed

# Tests, full (adds the censorwatch layer, which needs the dependencies):
python3 -m venv .venv && source .venv/bin/activate && pip install -r requirements.txt
PYTHONPATH=. python3 -m pytest tests/ censorwatch/tests/ -q   # adds the velocity-leg suite

A perna de velocidade ao vivo precisa de PostgreSQL, Redis e egresso dentro do país / na borda; veja censorwatch/DEPLOY.md. Ela permanece inerte a menos que CENSORWATCH_ENABLED esteja definido.

Documentação

DocumentoO que cobre
docs/INTEGRITY.mdO modelo de confiança em camadas, o que cada camada defende e o que nenhuma delas pode fazer
docs/DETECTIONS.mdO que o instrumento realmente capturou, com datas, e o que cada descoberta não estabelece
docs/EVAL-REGISTRY.mdO Registro de Avaliação Verificável: pré-registro, selagem e como verificá-lo
docs/EVAL-ASSURANCE.mdA escada de garantia afirmação por afirmação, contrato de evidências GFI v2 e regras de promoção
docs/EVAL-JOURNAL.mdO contrato de artigo vinculado a evidências, feeds, recibos e fluxo de publicação
docs/EVAL-FINDINGS.mdO renderizador determinístico de descobertas ao vivo, recibos de frases e revisões imutáveis
docs/BRI-WDI-OBSERVATIONS.mdA fronteira de contexto nacional do WDI, relógios de aquisição, direitos, recibo exato de publicação da Release A e procedimento de atualização
docs/GRANT-CASE.mdCaso pronto para financiamento, evidências, pacotes de trabalho falseáveis, riscos e resultados auditáveis
docs/METHODOLOGY.mdO método DDTI, a matemática e seu escopo e vieses honestos
docs/VALIDATION.mdBacktest de retrodição: o método captura eventos documentados?
docs/NEW-METHODS.mdAs superfícies de observação (Firewall Generativo, borda CDN, lista de bloqueio, silêncio, refúgio GitHub, Baike, Reconstrução Wayback)
docs/GREYBALL-METHODS.mdDez métodos de coleta Greyball / amigos da OTF, lista proibida, esquema de visibilidade, junção por chave exata
docs/UNDERTEXT.mdTomografia diferencial ativa, divergência de múltiplos pontos de observação como sinal
docs/BLEEDTHROUGH.mdTomografia de frota de injetores, o método e a linha de segurança para fazer os próprios dispositivos do censor responderem
docs/OSINT_SOURCES.mdCada fonte pública, como é acessada, o que produz, seus limites
docs/ETHICS.md · SAFETY.md · CONTRIBUTING.mdModelo de ameaça, regras de não causar dano e o portão de revisão de segurança

Status e licença

Desenvolvido abertamente como um bem público. Está além do estágio de protótipo e aquém de um produto acabado: vinte e oito feeds são atualizados sem supervisão em CI público, as cadeias seladas verificam offline a partir de um clone limpo, e tudo funciona sem que ninguém toque. O que ainda não é: replicado de forma independente, testemunhado externamente em escala ou dentro do país. Isso é declarado abertamente em docs/INTEGRITY.md e na tabela construído-versus-não acima, em vez de ser suavizado. Livre e de código aberto; não é um produto comercial e nunca monetiza as pessoas ou tópicos que observa. Licenciado sob a Licença MIT para que outras ferramentas possam livremente construir sobre os feeds e reutilizar as camadas de medição e selagem.

Agradecimentos e trabalho anterior

Palimpsest é construído para complementar, não repetir, o trabalho da China Digital Times, GreatFire, Citizen Lab e OONI. Ele ingere dados de exclusão do CDT como uma entrada e é projetado para compartilhar seus dados de volta. Baseia-se na tradição acadêmica de medição do WeiboScope e nos estudos de velocidade de exclusão de Zhu et al. (2013) e Bamman et al. (2012), cujas figuras de uma década atrás ele re-mede em vez de assumir. A camada de selagem baseia-se no trabalho de integridade de arquivos confiáveis (ARCHANGEL) e em construções padrão de logs de transparência.