AI 数据治理政策
资料治理 v2.0Version 2.0 · · Governance 2.0 public evidence surface
治理 2.0 摘要
此页已纳入 starnum 公开治理 2.0 介面,与系统卡、资料治理、透明度报告、使用政策和安全政策使用同一套证据层。
治理摘要
本页说明资料来源、知识库 chunks、翻译记忆与公开 artifacts 如何被追踪。
适用范围
涵盖知识库 lineage、翻译记忆稽核计数、隐私相关处理者、来源 hash 与公开 evidence manifests。
实作状态
2.0 将资料治理内容连接到机器可读 manifests 与验证指令。
当前数据生命周期(以程序实现为准)
本节是当前可验证规则;如旧版描述与本节冲突,以本节和实际程序为准。
- 存储内容包括出生年月日、性别、可选时辰与出生地元数据、命盘结构、解读结果、语言、方案状态及访问/移除令牌;出生资料属于个人资料,不宣称已经匿名化。
- 主数据存储在 Cloudflare R2,查询索引与状态存储在 D1;KV 仅用于有限期修复备份。Supabase 是默认关闭的旧事故备援,不是日常主路径。
- 前台可查询期限为免费 6 个月、普通 1 年、高级与特殊方案终身。免费/普通到期后删除 R2 命盘内容,仅保留精简消费者索引与订单/审计资料。
- 用户操作移除后会写入软删除状态,前台立即不可查询、列出或覆盖;后台数据与审计元数据仍保留。该操作应称为“从前台移除”,不是物理删除。
- 仅在实际启用 AI 生成或翻译时,才会把完成该工作所需的命盘结构或文字交给当时配置的供应商;对标表中的供应商名称不等于已经用于生产。
src/chart-storage.js · src/api-handler.js
外部标准与一手来源
以下链接是本页治理判断采用的一手标准;它们是对照基准,不代表第三方为本站背书。
目前机器稽核快照
此区块只使用本机可追溯的稽核资料,不新增无来源宣称。日期为实际产出日。
- data/state-machine/i18n-parity.json: 8,036 parent URLs, 7,976 articles.
- data/kb-machine-audit.json: 3,238 source files, 0 missing coverage, 0 orphan chunks.
- data/discovery-surface-audit.json: 0 errors, 0 warnings.
- data/sla-report.json: critical / 5 critical, 0 warnings.
内容维护与更新判断
此区块让治理页内容可被机器检查:每页都必须公开它依赖哪些资料、哪些关联页会影响它,以及哪个 gate 会提报需要更新。
更新判断
此页不是静态文案;来源资料、相关政策、公开指标或生成器变更时,AI Ops 只产出证据,由 AI agent 判断是否改文。
人工边界
系统负责侦测、提报与留证;最终修复与语气判断由 Codex/Claude 等 agent 执行。
验证指令
node scripts/verify-trust-pages.js --check
可查验 Evidence Layer
此区块不是口号;每一个核心宣称都有 claim id、来源 JSON、hash 与可重跑的验证指令。公开页只揭露可公开的治理证据,不公开原始码、密钥、私有资料或可被滥用的攻击面细节。
| Claim ID | 可查验值 | 状态 | 责任页 | 来源与验证 |
|---|---|---|---|---|
| claim.public-url-manifest.indexable-count 公开 URL 与 canonical 清单 |
38,965 indexable URLs | verified | sitewide | node scripts/generate-public-evidence-manifest.js --dry |
| claim.trust-pages.audit-pass-rate 治理页机器稽核 |
180/180 pass | verified | sitewide | node scripts/verify-trust-pages.js --check |
| claim.discovery-surface.zero-errors AI discovery surface 稽核 |
{"errors":0,"warnings":0} | verified | sitewide | node scripts/verify-discovery-surface.js |
| claim.structured-data.jsonld-errors JSON-LD / 结构化资料稽核 |
{"structured_data_invalid_files":0,"breadcrumb_count":28274,"faq_count":27506,"dataset_count":30,"article_count":27406} | verified | sitewide | node scripts/site-machine-audit.js |
| claim.status.sla-state 状态页 SLA 来源 |
critical / 5 critical, 0 warnings | verified | sitewide | node scripts/generate-status-page.js |
| claim.provider-alignment.openai-anthropic-gemini OpenAI / Anthropic / Google Gemini 对标 |
benchmark alignment only unless code/config evidence exists | verified | sitewide | node scripts/verify-public-evidence.js --check |
| claim.transparency-report.sha256 透明度报告 SHA-256 锚定 |
{"report":"transparency/report-2026-Q3.json","sha256":"47b09e2ca4e8b8fe9dffdfaccef3b11212de9ee3a8a14badca8044e2481203c5"} | verified | sitewide | node scripts/update-transparency-current-data.js |
| claim.release-integrity.gpg-signing GPG signing 状态 |
GPG signing configured locally; GitHub verification pending | github_verification_pending | sitewide | gpg --list-secret-keys --keyid-format=long && git log -1 --show-signature |
| claim.ai-data-governance.kb-lineage KB source file 与 chunk 谱系 |
{"state":"HEALTHY","counts":{"source_files":3238,"chunks":32724,"chunked_source_files":3238,"excluded_source_files":0,"missing_chunk_coverage":0,"orphan_chunks":0}} | verified | ai-data-governance | node scripts/verify-public-evidence.js --check |
| claim.ai-data-governance.tm-lineage TM 品质与标记项目 |
{"total_entries":789031,"counts":{"verified":34781,"template":0,"machine":754250,"flagged":0}} | verified | ai-data-governance | node scripts/tm-quality.js --stats |
| claim.ai-data-governance.public-artifacts 公开 evidence artifacts 部署清单 |
{"artifacts":["/data/public-evidence-manifest.json","/data/public-claim-registry.json","/data/public-verification-report.json"]} | verified | ai-data-governance | node scripts/verify-public-evidence.js --check |
系统卡 V2.0:技术透明公开层
此层把可公开的技术治理证据集中呈现:架构、资料来源、AI 使用边界、品质闸门、发布完整性与供应商对标。公开范围刻意排除原始码、密钥、可被滥用的攻击面细节与私人资料。
公开架构
Cloudflare Pages/Workers、R2/D1/KV/Pagefind 与本机生成脚本共同构成公开网站与治理资料发布链。对外只公开行为、状态与可验证资料源,不公开密钥或内部操作权限。
AI 使用揭露
程式码扫描目前可验证的 production inference 模型:未在 production code scan 中找到可验证模型设定。OpenAI、Anthropic、Google Gemini 三方作为治理框架对标;未有程式码或设定证据者,不写成已上线使用。
品质与安全闸门
治理页稽核 180/180 通过、JSON-LD 错误 0、discovery surface 错误 0。状态页如实显示 critical / 5 critical, 0 warnings。
资料与可追溯性
知识库 32,724 chunks、TM 789,031 entries、AI answer-ready 7,976/7,976。公开数据追到 data/state-machine/*、data/*audit*.json 与 transparency 报告。
| 治理面向 | OpenAI | Anthropic | Google Gemini | Starnum 落实证据 |
|---|---|---|---|---|
| 模型/系统卡揭露 | OpenAI models + safety docs | Claude model docs + system/model cards | Gemini model docs + safety settings | system-card、model-card、methodology、benchmark、transparency-log |
| 安全评估与使用边界 | Safety best practices / deployment checklist | Responsible Scaling / safety policy | Gemini safety controls / policy | AI safety、acceptable-use、ethics、risk boundary copy、crawler policy audit |
| 资料治理 | Data controls / privacy controls | privacy and data handling docs | Gemini API data governance references | privacy、ai-data-governance、KB/TM source tracking、SHA-256 hashes |
| 监控与发布 | production checklist / eval discipline | system-card transparency discipline | model/version documentation discipline | deploy.js、status.html、SLA report、trust-pages-machine-audit、sitemap/hreflang audits |
- 来源:data/state-machine/model-card.json、public-bench.json、trust-pages.json、security-headers.json。
- 来源:data/trust-pages-machine-audit.json、data/discovery-surface-audit.json、data/ai-answer-readiness-audit.json。
- 来源:data/kb-machine-audit.json、data/tm/quality-audit-report.json、data/sla-report.json。
- 官方对标文件检查日:2026-07-30;连结列于 OpenAI / Anthropic / Google Gemini 对标表。
V2.0 的重点不是多写形容词,而是把「已落实」与「尚未落实」分开:production 使用、治理对标、状态异常、GPG 签署、SLA breach 都依来源资料如实公开。
发布完整性与 GPG
GPG signing configured locally. signingkey=0934DFA0EDA6363A. GitHub verification pending until the public key upload and Verified badge are confirmed.
OpenAI / Anthropic / Google Gemini 对标
本站治理文件同步对照三家公开框架:模型文件、系统卡/模型卡、安全评估、资料治理与使用政策。这是治理对标,不等于宣称每一家都已用于 production inference。 官方文件检查日:2026-07-30
| 对标来源 | 治理焦点 | 本站揭露 | 官方来源 |
|---|---|---|---|
| OpenAI | 模型文件、最新模型说明、安全最佳实务、资料控制。 | 目前未在 production code scan 中找到可验证模型设定;模型供应商仅列为治理对标。 | https://platform.openai.com/docs/models |
| Anthropic | Claude 模型文件、system card / model card、Responsible Scaling 与安全政策。 | 目前未在 production code scan 中找到可验证模型设定;模型供应商仅列为治理对标。 | https://docs.anthropic.com/en/docs/about-claude/models |
| Google Gemini | Gemini API 模型文件、安全设定、资料治理与平台政策。 | 目前未在 production code scan 中找到可验证模型设定;模型供应商仅列为治理对标。 | https://ai.google.dev/gemini-api/docs/models |