Phương pháp An toàn AI
AI Safety v2.0Version 2.0 · · Governance 2.0 public evidence surface
Tổng quan Quản trị 2.0
Trang này thuộc bề mặt Quản trị 2.0 công khai của starnum, dùng chung lớp bằng chứng với thẻ hệ thống, quản trị dữ liệu, báo cáo minh bạch, chính sách sử dụng và chính sách bảo mật.
Tóm tắt quản trị
Trang này mô tả các biện pháp kiểm soát an toàn quanh việc diễn giải có AI hỗ trợ và tạo nội dung công khai.
Phạm vi áp dụng
Bao gồm văn bản ranh giới rủi ro, loại trừ lời khuyên y tế/pháp lý/tài chính, tín hiệu giám sát, công khai sự cố và ranh giới đối chiếu mô hình/nhà cung cấp.
Tình trạng triển khai
Phiên bản 2.0 gắn ngôn ngữ an toàn với các tuyên bố công khai, kiểm tra máy và trạng thái toàn vẹn phát hành.
starnum.com.tw hoạt động hoàn toàn dưới sự tự động hóa AI (Claude Code là trưởng nhóm kỹ thuật). Trong một hệ thống hoàn toàn được điều khiển bởi AI, bảo mật không phải là biện pháp bảo vệ hồi tố — mà là nguyên tắc thiết kế cốt lõi của kiến trúc. Trang này giải thích cách chúng tôi triển khai an toàn AI, thay vì chỉ tuyên bố các cam kết đạo đức.
1. Giao thức Red Team
Red teaming là phương pháp kiểm tra đối nghịch chủ động cố gắng làm cho hệ thống AI vi phạm quy tắc để phát hiện lỗ hổng bảo mật.
1.1 Công cụ kiểm thử
Sử dụng công cụ kiểm thử Red Team tự động để định kỳ thực hiện các loại kiểm thử sau:
| Loại kiểm thử | Tình huống kiểm thử | Hành vi kỳ vọng |
|---|---|---|
| Kiểm thử ranh giới đạo đức | Yêu cầu dự đoán thời điểm tử vong, chẩn đoán bệnh | Từ chối tạo nội dung, báo cáo cho người dùng |
| Kiểm thử bảo vệ danh tính | Yêu cầu phân tích lá số chính trị gia, trẻ vị thành niên | Từ chối, không tạo bất kỳ nội dung nào |
| Kiểm thử Prompt Injection | Chèn lệnh thao túng vào đầu vào | Phát hiện và cách ly, đưa nguồn vào danh sách đen |
| Kiểm thử mâu thuẫn logic mệnh lý | Nhập cấu hình lá số mâu thuẫn | Kích hoạt cơ chế xác minh logic mệnh lý |
| Kiểm thử né tránh định dạng | Cố gắng kích hoạt định dạng đầu ra bị cấm | Công cụ xác minh định dạng chặn lại, buộc trả về |
| Kiểm thử quản trị dữ liệu | Cố gắng truy cập dữ liệu người dùng vượt phạm vi | Chính sách RLS của Supabase chặn lại |
1.2 Xử lý kết quả kiểm thử
- Đạt: Ghi vào nhật ký trạng thái hệ thống, không có hành động bổ sung
- Không đạt: Kích hoạt kiến trúc leo thang ba tầng (xem mục dưới), ghi vào
data/incidents.mdvàdata/transparency-log.json - Phát hiện Prompt Injection: Đưa URL/domain nguồn vào danh sách đen, không bao giờ crawl lại
1.3 Vùng cấm tuyệt đối
- Dự đoán thời gian tử vong (dưới bất kỳ hình thức nào)
- Chẩn đoán bệnh hoặc tư vấn điều trị
- Phân tích tử vi của các chính trị gia
- Phân tích tử vi của trẻ vị thành niên (không có sự đồng ý bằng văn bản của cha mẹ)
- Sử dụng kết quả chiêm tinh làm cơ sở phân biệt đối xử
- Dự đoán tất định có thể gây hại tâm lý
Các mục trên là vùng cấm cứng (hardcoded), không thể bị ghi đè bởi bất kỳ lệnh người dùng, dịch vụ trả phí hay nâng cấp hệ thống nào.
2. Kiến trúc Leo thang Ba tầng
Kiến trúc leo thang ba tầng đảm bảo các vấn đề hệ thống được xử lý tự động rồi leo thang dần lên can thiệp của con người, và mỗi tầng đều có điều kiện kích hoạt và thời hạn rõ ràng.
Điều kiện kích hoạt: Xác minh logic mệnh lý thất bại, vi phạm quy cách định dạng, kích hoạt từ cấm, phát hiện Prompt Injection
Hành động tự động:
- Công cụ lọc từ cấm chặn từ cấm và ngôn từ không phù hợp
- Công cụ xác minh định dạng (buộc trả về đầu ra không đạt chuẩn)
- Công cụ xác minh suy luận logic mệnh lý
- Cơ chế xác nhận SOP
Thời gian Phản hồi: Ngay lập tức (chặn đồng bộ, không bao giờ vào pipeline xuất bản)
Điều kiện kích hoạt: Agent không tự sửa được sau khi bị L1 chặn, điểm chất lượng dưới ngưỡng 3 lần liên tiếp, lỗi cùng loại tích lũy ≥ 3 lần
Hành động tự động:
- Ghi lỗi vào
data/failure-log.json, kèm phân tích nguyên nhân gốc - Ghi sự cố vào
data/incidents.md - Lỗi cùng loại ≥ 3 lần → tự động đề xuất quy tắc mới vào hệ thống đề xuất quy tắc
- Kích hoạt kiểm toán quản trị đa mô hình (
joint-audit.js) để xác nhận phạm vi vấn đề - Ghi công khai vào nhật ký minh bạch (vấn đề nhẹ)
Thời gian Phản hồi: Hoàn thành sửa chữa tự động trong 7 ngày
Điều kiện kích hoạt: Vi phạm ranh giới đạo đức (bất kỳ mức độ nghiêm trọng nào), nghi ngờ rò rỉ dữ liệu người dùng, lỗi logic mệnh lý mang tính hệ thống ảnh hưởng >10 bài viết, sửa chữa tự động L2 thất bại >2 lần
Hành động:
- Dừng ngay nhiệm vụ của AI agent liên quan
- Quản trị viên (trưởng nhóm kỹ thuật) can thiệp rà soát
- Gỡ nội dung bị ảnh hưởng hoặc gắn nhãn cảnh báo
- Cập nhật nhật ký minh bạch công khai (trong vòng 72 giờ)
- Sau khi hoàn thành phân tích nguyên nhân gốc, cập nhật skill-pack/SOP tương ứng
Thời gian Phản hồi: CRITICAL trong 4h / MAJOR trong 24h để bắt đầu xem xét của con người
3. Nguyên lý Thiết kế Bộ Đánh giá Eval
Bộ đánh giá (Eval Set) là tập hợp lá số thử nghiệm cố định, dùng để xác minh chất lượng đầu ra không suy giảm sau mỗi lần cập nhật hệ thống (kiểm thử hồi quy).
3.1 Nguyên tắc thiết kế
3.2 Thời điểm kích hoạt
- Bắt buộc chạy sau khi bất kỳ tài liệu quy phạm cốt lõi nào được cập nhật
- Bắt buộc chạy sau khi bất kỳ tài liệu SOP nào được cập nhật
- Chạy một lần trước và sau khi nâng cấp phiên bản mô hình AI (đối chiếu khác biệt)
- Là một phần của rà soát toàn trang mỗi Chủ nhật (
benchmark-run.js)
3.3 Chiều đánh giá
| Chiều | Công cụ | Ngưỡng |
|---|---|---|
| Tuân thủ định dạng | Công cụ xác minh định dạng | Đạt 100% (exit 0) |
| Chính xác logic mệnh lý | Công cụ xác minh logic mệnh lý | 0 vi phạm quy tắc cứng |
| Xác nhận đã đọc SOP | Công cụ xác nhận SOP | 100% có xác nhận "✅ Đã đọc SOP" |
| Tuân thủ ranh giới đạo đức | Công cụ lọc từ cấm | 0 lần kích hoạt từ cấm |
| Độ bao phủ (bảy lớp) | Công cụ kiểm tra độ bao phủ | Bao phủ ≥ 80% |
→ Trang Benchmark: xem kết quả đánh giá công khai và tiêu chuẩn chấm điểm
4. Điều kiện Kích hoạt Giám sát Con người
Mặc dù mức độ tự động hóa AI của trang rất cao, các tình huống sau đây bắt buộc phải kích hoạt sự can thiệp (thủ công) của quản trị viên:
| Điều kiện kích hoạt | Loại | Mức khẩn cấp |
|---|---|---|
| Bất kỳ vi phạm ranh giới đạo đức nào (kích hoạt vùng cấm tuyệt đối) | Đạo đức | Ngay lập tức |
| Nghi ngờ rò rỉ dữ liệu người dùng hoặc truy cập trái phép | Bảo mật | Ngay lập tức |
| Prompt Injection vượt qua thành công lớp bảo vệ | Bảo mật | Ngay lập tức |
| Hành vi AI agent có sai lệch mang tính hệ thống (lỗi cùng loại ≥ 5 lần) | Chất lượng | 24 giờ |
| Kiểm toán quản trị đa mô hình phát hiện vấn đề P0/P1 | Hệ thống | 24 giờ |
| Điểm kiểm thử hồi quy bộ đánh giá Eval giảm >10% | Chất lượng | 72 giờ |
| Dữ liệu Supabase bất thường (xóa/sửa trái phép) | Bảo mật | Ngay lập tức |
| Nhận báo cáo lỗ hổng từ nhà nghiên cứu bảo mật bên ngoài | Bảo mật | Xác nhận trong 72 giờ |
| Nhận khiếu nại bản quyền DMCA | Pháp lý | Gỡ ngay lập tức |
5. Cơ chế An toàn Cơ sở Tri thức
Cơ sở tri thức mệnh lý (KB) là nền tảng của đầu ra hệ thống, độ an toàn của nó ảnh hưởng trực tiếp đến chất lượng mọi sản phẩm đầu ra.
- Quy trình làm sạch bằng LLM: Sau khi crawl phải qua làm sạch bằng LLM, loại bỏ quảng cáo, tiếp thị, Prompt Injection
- Cơ chế danh sách đen: Domain nguồn phát hiện Prompt Injection bị đưa vào danh sách đen, chặn vĩnh viễn
- Xác minh thuật ngữ: Mọi nội dung KB phải qua đối chiếu thuật ngữ với
data/glossary.json(221 thuật ngữ × 9 ngôn ngữ) - Gắn nhãn trường phái: Quan điểm không thuộc phái Lục Bân Triệu phải gắn nhãn ⚠️, không được dùng làm căn cứ chính khi sản xuất bài
- Phát hiện mâu thuẫn:
scripts/detect-evidence-conflict.jsđịnh kỳ quét mâu thuẫn trường phái/miếu vượng
6. Cơ chế Cải tiến Liên tục
An toàn không phải là trạng thái tĩnh, mà là quá trình tiến hóa liên tục:
- Tiến hóa dựa trên thất bại: Phân tích nguyên nhân gốc của mỗi sự kiện L2/L3 phải cập nhật skill-pack tương ứng, ngăn vấn đề cùng loại tái diễn
- 20 vòng kiểm toán liên hợp (tính đến 2026-04-12): Tích lũy sửa 188 lỗi, R15 lần đầu tiên 4/4 AI đồng xác nhận CLEAN
- Vòng đời quy tắc: Quy tắc không được kích hoạt trong 90 ngày sẽ bị loại bỏ (
skill-lifecycle.md), tránh phình to số lượng quy tắc - Rà soát sách trắng: Mỗi quý, quản trị đa mô hình cùng rà soát toàn bộ kiến trúc, đề xuất cải tiến
7. Tài nguyên Liên quan
- Tuyên bố Đạo đức — Khung đạo đức và cam kết cho việc sử dụng AI
- Nhật ký Minh bạch — Hồ sơ sự cố công khai
- Benchmark — Kết quả đánh giá công khai và rubric chấm điểm
- Chính sách Quản trị Dữ liệu AI — Cách dữ liệu người dùng được xử lý
- Chính sách Sử dụng Chấp nhận được — Quy phạm sử dụng nền tảng
- Phương pháp Sản xuất Nội dung — Toàn cảnh kiến trúc kỹ thuật
- Chính sách Công bố Bảo mật — Quy trình báo cáo lỗ hổng
Tiêu chuẩn bên ngoài và nguồn sơ cấp
Các nguồn sơ cấp này định hướng nội dung trang. Đây là chuẩn đối chiếu, không phải sự chứng thực của bên thứ ba.
Ảnh chụp Kiểm toán Máy Hiện tại
Khối này chỉ dùng dữ liệu kiểm toán có thể truy vết tại chỗ, không thêm số liệu hay tuyên bố không có nguồn. Ngày hiển thị là ngày tạo thực tế.
- data/state-machine/i18n-parity.json: 8,036 parent URLs, 7,976 articles.
- data/kb-machine-audit.json: 3,238 source files, 0 missing coverage, 0 orphan chunks.
- data/discovery-surface-audit.json: 0 errors, 0 warnings.
- data/sla-report.json: critical / 4 critical, 0 warnings.
Bảo trì Nội dung và Quyết định Cập nhật
Khối này giúp nội dung trang quản trị có thể được máy kiểm tra: mỗi trang phải công khai dữ liệu mà nó phụ thuộc, các trang liên quan ảnh hưởng đến nó, và gate nào sẽ báo cáo nhu cầu cập nhật.
Quyết định cập nhật
Trang này không phải nội dung tĩnh; khi dữ liệu nguồn, chính sách liên quan, chỉ số công khai hoặc trình tạo thay đổi, AI Ops chỉ tạo ra bằng chứng, còn AI agent sẽ quyết định có cần sửa nội dung hay không.
Ranh giới con người
Hệ thống chịu trách nhiệm phát hiện, báo cáo và lưu bằng chứng; việc sửa chữa cuối cùng và phán đoán văn phong do các agent như Codex/Claude thực hiện.
Lệnh xác minh
node scripts/verify-trust-pages.js --check
data/sla-report.jsondata/public-claim-registry.jsondata/discovery-surface-audit.json- Trang quản trị liên quan: Chính sách sử dụng · Chính sách bảo mật · Thẻ hệ thống · Báo cáo minh bạch
- Quy trình cập nhật:
npm run update:trust-pages→npm run test:trust
Ảnh chụp Kiểm toán Máy Hiện tại
Khối này chỉ dùng dữ liệu kiểm toán có thể truy vết tại chỗ, không thêm số liệu hay tuyên bố không có nguồn. Ngày hiển thị là ngày tạo thực tế.
- data/state-machine/i18n-parity.json: 8,036 parent URLs, 7,976 articles.
- data/kb-machine-audit.json: 3,238 source files, 0 missing coverage, 0 orphan chunks.
- data/discovery-surface-audit.json: 0 errors, 0 warnings.
- data/sla-report.json: critical / 4 critical, 0 warnings.
Bảo trì Nội dung và Quyết định Cập nhật
Khối này giúp nội dung trang quản trị có thể được máy kiểm tra: mỗi trang phải công khai dữ liệu mà nó phụ thuộc, các trang liên quan ảnh hưởng đến nó, và gate nào sẽ báo cáo nhu cầu cập nhật.
Quyết định cập nhật
Trang này không phải nội dung tĩnh; khi dữ liệu nguồn, chính sách liên quan, chỉ số công khai hoặc trình tạo thay đổi, AI Ops chỉ tạo ra bằng chứng, còn AI agent sẽ quyết định có cần sửa nội dung hay không.
Ranh giới con người
Hệ thống chịu trách nhiệm phát hiện, báo cáo và lưu bằng chứng; việc sửa chữa cuối cùng và phán đoán văn phong do các agent như Codex/Claude thực hiện.
Lệnh xác minh
node scripts/verify-trust-pages.js --check
data/sla-report.jsondata/public-claim-registry.jsondata/discovery-surface-audit.json- Trang quản trị liên quan: Chính sách sử dụng · Chính sách bảo mật · Thẻ hệ thống · Báo cáo minh bạch
- Quy trình cập nhật:
npm run update:trust-pages→npm run test:trust
Ảnh chụp Kiểm toán Máy Hiện tại
Khối này chỉ dùng dữ liệu kiểm toán có thể truy vết tại chỗ, không thêm số liệu hay tuyên bố không có nguồn. Ngày hiển thị là ngày tạo thực tế.
- data/state-machine/i18n-parity.json: 8,036 parent URLs, 7,976 articles.
- data/kb-machine-audit.json: 3,238 source files, 0 missing coverage, 0 orphan chunks.
- data/discovery-surface-audit.json: 0 errors, 0 warnings.
- data/sla-report.json: critical / 4 critical, 0 warnings.
Bảo trì Nội dung và Quyết định Cập nhật
Khối này giúp nội dung trang quản trị có thể được máy kiểm tra: mỗi trang phải công khai dữ liệu mà nó phụ thuộc, các trang liên quan ảnh hưởng đến nó, và gate nào sẽ báo cáo nhu cầu cập nhật.
Quyết định cập nhật
Trang này không phải nội dung tĩnh; khi dữ liệu nguồn, chính sách liên quan, chỉ số công khai hoặc trình tạo thay đổi, AI Ops chỉ tạo ra bằng chứng, còn AI agent sẽ quyết định có cần sửa nội dung hay không.
Ranh giới con người
Hệ thống chịu trách nhiệm phát hiện, báo cáo và lưu bằng chứng; việc sửa chữa cuối cùng và phán đoán văn phong do các agent như Codex/Claude thực hiện.
Lệnh xác minh
node scripts/verify-trust-pages.js --check
data/sla-report.jsondata/public-claim-registry.jsondata/discovery-surface-audit.json- Trang quản trị liên quan: Chính sách sử dụng · Chính sách bảo mật · Thẻ hệ thống · Báo cáo minh bạch
- Quy trình cập nhật:
npm run update:trust-pages→npm run test:trust
Lớp Bằng chứng Có thể Kiểm chứng
Khối này không phải khẩu hiệu; mỗi tuyên bố cốt lõi đều có claim id, JSON nguồn, hash và lệnh xác minh có thể chạy lại. Trang công khai chỉ tiết lộ bằng chứng quản trị có thể công khai, không tiết lộ mã nguồn, khóa bí mật, dữ liệu riêng tư hay chi tiết bề mặt tấn công có thể bị lạm dụng.
| Claim ID | Giá trị có thể kiểm chứng | Trạng thái | Trang phụ trách | Nguồn và xác minh |
|---|---|---|---|---|
| claim.public-url-manifest.indexable-count Danh mục URL công khai và canonical |
38,965 indexable URLs | verified | sitewide | node scripts/generate-public-evidence-manifest.js --dry |
| claim.trust-pages.audit-pass-rate Kiểm toán máy các trang quản trị |
180/180 pass | verified | sitewide | node scripts/verify-trust-pages.js --check |
| claim.discovery-surface.zero-errors Kiểm toán AI discovery surface |
{"errors":0,"warnings":0} | verified | sitewide | node scripts/verify-discovery-surface.js |
| claim.structured-data.jsonld-errors Kiểm toán JSON-LD / dữ liệu có cấu trúc |
{"structured_data_invalid_files":0,"breadcrumb_count":28274,"faq_count":27506,"dataset_count":30,"article_count":27406} | verified | sitewide | node scripts/site-machine-audit.js |
| claim.status.sla-state Nguồn SLA trang trạng thái |
critical / 5 critical, 0 warnings | verified | sitewide | node scripts/generate-status-page.js |
| claim.provider-alignment.openai-anthropic-gemini Đối chiếu OpenAI / Anthropic / Google Gemini |
benchmark alignment only unless code/config evidence exists | verified | sitewide | node scripts/verify-public-evidence.js --check |
| claim.transparency-report.sha256 Neo SHA-256 báo cáo minh bạch |
{"report":"transparency/report-2026-Q3.json","sha256":"47b09e2ca4e8b8fe9dffdfaccef3b11212de9ee3a8a14badca8044e2481203c5"} | verified | sitewide | node scripts/update-transparency-current-data.js |
| claim.release-integrity.gpg-signing Trạng thái ký GPG |
GPG signing configured locally; GitHub verification pending | github_verification_pending | sitewide | gpg --list-secret-keys --keyid-format=long && git log -1 --show-signature |
Thẻ Hệ thống V2.0: Lớp Minh bạch Kỹ thuật Công khai
Lớp này tập hợp các bằng chứng quản trị kỹ thuật có thể công khai: kiến trúc, nguồn dữ liệu, ranh giới sử dụng AI, cổng chất lượng, toàn vẹn phát hành và đối chiếu nhà cung cấp. Phạm vi công khai cố ý loại trừ mã nguồn, khóa bí mật, chi tiết bề mặt tấn công có thể bị lạm dụng và dữ liệu cá nhân.
Kiến trúc công khai
Cloudflare Pages/Workers, R2/D1/KV/Pagefind và các script tạo nội dung cục bộ cùng tạo thành chuỗi phát hành trang công khai và dữ liệu quản trị. Bên ngoài chỉ công khai hành vi, trạng thái và nguồn dữ liệu có thể kiểm chứng, không công khai khóa bí mật hay quyền vận hành nội bộ.
Công khai sử dụng AI
Quét mã nguồn hiện xác minh cấu hình mô hình production inference: chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production. OpenAI, Anthropic và Google Gemini được dùng làm đối chiếu khung quản trị; nhà cung cấp không có bằng chứng mã nguồn hoặc cấu hình sẽ không được ghi nhận là đã đưa vào sử dụng chính thức.
Cổng chất lượng và an toàn
Kiểm toán trang quản trị đạt 180/180, lỗi JSON-LD 0, lỗi discovery surface 0. Trang trạng thái hiển thị đúng thực tế: critical / 4 critical, 0 warnings.
Dữ liệu và khả năng truy vết
Cơ sở tri thức 32,724 chunks, TM 512,152 entries, AI answer-ready 7,976/7,976. Dữ liệu công khai truy vết về data/state-machine/*, data/*audit*.json và báo cáo transparency.
| Lĩnh vực quản trị | OpenAI | Anthropic | Google Gemini | Bằng chứng triển khai của Starnum |
|---|---|---|---|---|
| Công khai model/system card | OpenAI models + safety docs | Claude model docs + system/model cards | Gemini model docs + safety settings | system-card, model-card, methodology, benchmark, transparency-log |
| Đánh giá an toàn và ranh giới sử dụng | Safety best practices / deployment checklist | Responsible Scaling / safety policy | Gemini safety controls / policy | AI safety, acceptable-use, ethics, risk-boundary copy, crawler policy audit |
| Quản trị dữ liệu | Data controls / privacy controls | privacy and data handling docs | Gemini API data governance references | privacy, ai-data-governance, KB/TM source tracking, SHA-256 hashes |
| Giám sát và phát hành | production checklist / eval discipline | system-card transparency discipline | model/version documentation discipline | deploy.js, status.html, SLA report, trust-pages-machine-audit, sitemap/hreflang audits |
- Nguồn: data/state-machine/model-card.json, public-bench.json, trust-pages.json, security-headers.json.
- Nguồn: data/trust-pages-machine-audit.json, data/discovery-surface-audit.json, data/ai-answer-readiness-audit.json.
- Nguồn: data/kb-machine-audit.json, data/tm/quality-audit-report.json, data/sla-report.json.
- Ngày kiểm tra tài liệu đối chiếu chính thức: 2026-08-19; liên kết được liệt kê trong bảng đối chiếu OpenAI / Anthropic / Google Gemini.
Trọng tâm của V2.0 không phải là thêm tính từ, mà là tách rõ "đã triển khai" và "chưa triển khai": việc sử dụng production, đối chiếu quản trị, bất thường trạng thái, ký GPG và vi phạm SLA đều được công khai đúng theo dữ liệu nguồn.
Toàn vẹn Phát hành và GPG
Đã cấu hình ký GPG cục bộ. signingkey=0934DFA0EDA6363A. Đang chờ xác minh trên GitHub cho đến khi tải lên khóa công khai và xác nhận huy hiệu Verified.
Đối chiếu OpenAI / Anthropic / Google Gemini
Tài liệu quản trị của trang được đối chiếu đồng thời với ba khung công khai: tài liệu mô hình, system card/model card, đánh giá an toàn, quản trị dữ liệu và chính sách sử dụng. Đây là đối chiếu quản trị, không phải tuyên bố rằng mọi nhà cung cấp đều đã dùng cho production inference. Ngày kiểm tra tài liệu chính thức: 2026-08-19
| Nhà cung cấp đối chiếu | Trọng tâm quản trị | Công khai của Starnum | Nguồn chính thức |
|---|---|---|---|
| OpenAI | Tài liệu mô hình, ghi chú mô hình mới nhất, thực hành an toàn tốt nhất và kiểm soát dữ liệu. | Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị. | https://platform.openai.com/docs/models |
| Anthropic | Tài liệu mô hình Claude, system card/model card, Responsible Scaling và chính sách an toàn. | Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị. | https://docs.anthropic.com/en/docs/about-claude/models |
| Google Gemini | Tài liệu mô hình Gemini API, cài đặt an toàn, quản trị dữ liệu và chính sách nền tảng. | Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị. | https://ai.google.dev/gemini-api/docs/models |
Lớp Bằng chứng Có thể Kiểm chứng
Khối này không phải khẩu hiệu; mỗi tuyên bố cốt lõi đều có claim id, JSON nguồn, hash và lệnh xác minh có thể chạy lại. Trang công khai chỉ tiết lộ bằng chứng quản trị có thể công khai, không tiết lộ mã nguồn, khóa bí mật, dữ liệu riêng tư hay chi tiết bề mặt tấn công có thể bị lạm dụng.
| Claim ID | Giá trị có thể kiểm chứng | Trạng thái | Trang phụ trách | Nguồn và xác minh |
|---|---|---|---|---|
| claim.public-url-manifest.indexable-count Danh mục URL công khai và canonical |
38,965 indexable URLs | verified | sitewide | node scripts/generate-public-evidence-manifest.js --dry |
| claim.trust-pages.audit-pass-rate Kiểm toán máy các trang quản trị |
180/180 pass | verified | sitewide | node scripts/verify-trust-pages.js --check |
| claim.discovery-surface.zero-errors Kiểm toán AI discovery surface |
{"errors":0,"warnings":0} | verified | sitewide | node scripts/verify-discovery-surface.js |
| claim.structured-data.jsonld-errors Kiểm toán JSON-LD / dữ liệu có cấu trúc |
{"structured_data_invalid_files":0,"breadcrumb_count":28274,"faq_count":27506,"dataset_count":30,"article_count":27406} | verified | sitewide | node scripts/site-machine-audit.js |
| claim.status.sla-state Nguồn SLA trang trạng thái |
critical / 5 critical, 0 warnings | verified | sitewide | node scripts/generate-status-page.js |
| claim.provider-alignment.openai-anthropic-gemini Đối chiếu OpenAI / Anthropic / Google Gemini |
benchmark alignment only unless code/config evidence exists | verified | sitewide | node scripts/verify-public-evidence.js --check |
| claim.transparency-report.sha256 Neo SHA-256 báo cáo minh bạch |
{"report":"transparency/report-2026-Q3.json","sha256":"47b09e2ca4e8b8fe9dffdfaccef3b11212de9ee3a8a14badca8044e2481203c5"} | verified | sitewide | node scripts/update-transparency-current-data.js |
| claim.release-integrity.gpg-signing Trạng thái ký GPG |
GPG signing configured locally; GitHub verification pending | github_verification_pending | sitewide | gpg --list-secret-keys --keyid-format=long && git log -1 --show-signature |
Thẻ Hệ thống V2.0: Lớp Minh bạch Kỹ thuật Công khai
Lớp này tập hợp các bằng chứng quản trị kỹ thuật có thể công khai: kiến trúc, nguồn dữ liệu, ranh giới sử dụng AI, cổng chất lượng, toàn vẹn phát hành và đối chiếu nhà cung cấp. Phạm vi công khai cố ý loại trừ mã nguồn, khóa bí mật, chi tiết bề mặt tấn công có thể bị lạm dụng và dữ liệu cá nhân.
Kiến trúc công khai
Cloudflare Pages/Workers, R2/D1/KV/Pagefind và các script tạo nội dung cục bộ cùng tạo thành chuỗi phát hành trang công khai và dữ liệu quản trị. Bên ngoài chỉ công khai hành vi, trạng thái và nguồn dữ liệu có thể kiểm chứng, không công khai khóa bí mật hay quyền vận hành nội bộ.
Công khai sử dụng AI
Quét mã nguồn hiện xác minh cấu hình mô hình production inference: chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production. OpenAI, Anthropic và Google Gemini được dùng làm đối chiếu khung quản trị; nhà cung cấp không có bằng chứng mã nguồn hoặc cấu hình sẽ không được ghi nhận là đã đưa vào sử dụng chính thức.
Cổng chất lượng và an toàn
Kiểm toán trang quản trị đạt 180/180, lỗi JSON-LD 0, lỗi discovery surface 0. Trang trạng thái hiển thị đúng thực tế: critical / 4 critical, 0 warnings.
Dữ liệu và khả năng truy vết
Cơ sở tri thức 32,724 chunks, TM 512,152 entries, AI answer-ready 7,976/7,976. Dữ liệu công khai truy vết về data/state-machine/*, data/*audit*.json và báo cáo transparency.
| Lĩnh vực quản trị | OpenAI | Anthropic | Google Gemini | Bằng chứng triển khai của Starnum |
|---|---|---|---|---|
| Công khai model/system card | OpenAI models + safety docs | Claude model docs + system/model cards | Gemini model docs + safety settings | system-card, model-card, methodology, benchmark, transparency-log |
| Đánh giá an toàn và ranh giới sử dụng | Safety best practices / deployment checklist | Responsible Scaling / safety policy | Gemini safety controls / policy | AI safety, acceptable-use, ethics, risk-boundary copy, crawler policy audit |
| Quản trị dữ liệu | Data controls / privacy controls | privacy and data handling docs | Gemini API data governance references | privacy, ai-data-governance, KB/TM source tracking, SHA-256 hashes |
| Giám sát và phát hành | production checklist / eval discipline | system-card transparency discipline | model/version documentation discipline | deploy.js, status.html, SLA report, trust-pages-machine-audit, sitemap/hreflang audits |
- Nguồn: data/state-machine/model-card.json, public-bench.json, trust-pages.json, security-headers.json.
- Nguồn: data/trust-pages-machine-audit.json, data/discovery-surface-audit.json, data/ai-answer-readiness-audit.json.
- Nguồn: data/kb-machine-audit.json, data/tm/quality-audit-report.json, data/sla-report.json.
- Ngày kiểm tra tài liệu đối chiếu chính thức: 2026-08-19; liên kết được liệt kê trong bảng đối chiếu OpenAI / Anthropic / Google Gemini.
Trọng tâm của V2.0 không phải là thêm tính từ, mà là tách rõ "đã triển khai" và "chưa triển khai": việc sử dụng production, đối chiếu quản trị, bất thường trạng thái, ký GPG và vi phạm SLA đều được công khai đúng theo dữ liệu nguồn.
Toàn vẹn Phát hành và GPG
Đã cấu hình ký GPG cục bộ. signingkey=0934DFA0EDA6363A. Đang chờ xác minh trên GitHub cho đến khi tải lên khóa công khai và xác nhận huy hiệu Verified.
Đối chiếu OpenAI / Anthropic / Google Gemini
Tài liệu quản trị của trang được đối chiếu đồng thời với ba khung công khai: tài liệu mô hình, system card/model card, đánh giá an toàn, quản trị dữ liệu và chính sách sử dụng. Đây là đối chiếu quản trị, không phải tuyên bố rằng mọi nhà cung cấp đều đã dùng cho production inference. Ngày kiểm tra tài liệu chính thức: 2026-08-19
| Nhà cung cấp đối chiếu | Trọng tâm quản trị | Công khai của Starnum | Nguồn chính thức |
|---|---|---|---|
| OpenAI | Tài liệu mô hình, ghi chú mô hình mới nhất, thực hành an toàn tốt nhất và kiểm soát dữ liệu. | Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị. | https://platform.openai.com/docs/models |
| Anthropic | Tài liệu mô hình Claude, system card/model card, Responsible Scaling và chính sách an toàn. | Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị. | https://docs.anthropic.com/en/docs/about-claude/models |
| Google Gemini | Tài liệu mô hình Gemini API, cài đặt an toàn, quản trị dữ liệu và chính sách nền tảng. | Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị. | https://ai.google.dev/gemini-api/docs/models |
Lớp Bằng chứng Có thể Kiểm chứng
Khối này không phải khẩu hiệu; mỗi tuyên bố cốt lõi đều có claim id, JSON nguồn, hash và lệnh xác minh có thể chạy lại. Trang công khai chỉ tiết lộ bằng chứng quản trị có thể công khai, không tiết lộ mã nguồn, khóa bí mật, dữ liệu riêng tư hay chi tiết bề mặt tấn công có thể bị lạm dụng.
| Claim ID | Giá trị có thể kiểm chứng | Trạng thái | Trang phụ trách | Nguồn và xác minh |
|---|---|---|---|---|
| claim.public-url-manifest.indexable-count Danh mục URL công khai và canonical |
38,965 indexable URLs | verified | sitewide | node scripts/generate-public-evidence-manifest.js --dry |
| claim.trust-pages.audit-pass-rate Kiểm toán máy các trang quản trị |
180/180 pass | verified | sitewide | node scripts/verify-trust-pages.js --check |
| claim.discovery-surface.zero-errors Kiểm toán AI discovery surface |
{"errors":0,"warnings":0} | verified | sitewide | node scripts/verify-discovery-surface.js |
| claim.structured-data.jsonld-errors Kiểm toán JSON-LD / dữ liệu có cấu trúc |
{"structured_data_invalid_files":0,"breadcrumb_count":28274,"faq_count":27506,"dataset_count":30,"article_count":27406} | verified | sitewide | node scripts/site-machine-audit.js |
| claim.status.sla-state Nguồn SLA trang trạng thái |
critical / 5 critical, 0 warnings | verified | sitewide | node scripts/generate-status-page.js |
| claim.provider-alignment.openai-anthropic-gemini Đối chiếu OpenAI / Anthropic / Google Gemini |
benchmark alignment only unless code/config evidence exists | verified | sitewide | node scripts/verify-public-evidence.js --check |
| claim.transparency-report.sha256 Neo SHA-256 báo cáo minh bạch |
{"report":"transparency/report-2026-Q3.json","sha256":"47b09e2ca4e8b8fe9dffdfaccef3b11212de9ee3a8a14badca8044e2481203c5"} | verified | sitewide | node scripts/update-transparency-current-data.js |
| claim.release-integrity.gpg-signing Trạng thái ký GPG |
GPG signing configured locally; GitHub verification pending | github_verification_pending | sitewide | gpg --list-secret-keys --keyid-format=long && git log -1 --show-signature |
Thẻ Hệ thống V2.0: Lớp Minh bạch Kỹ thuật Công khai
Lớp này tập hợp các bằng chứng quản trị kỹ thuật có thể công khai: kiến trúc, nguồn dữ liệu, ranh giới sử dụng AI, cổng chất lượng, toàn vẹn phát hành và đối chiếu nhà cung cấp. Phạm vi công khai cố ý loại trừ mã nguồn, khóa bí mật, chi tiết bề mặt tấn công có thể bị lạm dụng và dữ liệu cá nhân.
Kiến trúc công khai
Cloudflare Pages/Workers, R2/D1/KV/Pagefind và các script tạo nội dung cục bộ cùng tạo thành chuỗi phát hành trang công khai và dữ liệu quản trị. Bên ngoài chỉ công khai hành vi, trạng thái và nguồn dữ liệu có thể kiểm chứng, không công khai khóa bí mật hay quyền vận hành nội bộ.
Công khai sử dụng AI
Quét mã nguồn hiện xác minh cấu hình mô hình production inference: chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production. OpenAI, Anthropic và Google Gemini được dùng làm đối chiếu khung quản trị; nhà cung cấp không có bằng chứng mã nguồn hoặc cấu hình sẽ không được ghi nhận là đã đưa vào sử dụng chính thức.
Cổng chất lượng và an toàn
Kiểm toán trang quản trị đạt 180/180, lỗi JSON-LD 0, lỗi discovery surface 0. Trang trạng thái hiển thị đúng thực tế: critical / 4 critical, 0 warnings.
Dữ liệu và khả năng truy vết
Cơ sở tri thức 32,724 chunks, TM 0 entries, AI answer-ready 7,976/7,976. Dữ liệu công khai truy vết về data/state-machine/*, data/*audit*.json và báo cáo transparency.
| Lĩnh vực quản trị | OpenAI | Anthropic | Google Gemini | Bằng chứng triển khai của Starnum |
|---|---|---|---|---|
| Công khai model/system card | OpenAI models + safety docs | Claude model docs + system/model cards | Gemini model docs + safety settings | system-card, model-card, methodology, benchmark, transparency-log |
| Đánh giá an toàn và ranh giới sử dụng | Safety best practices / deployment checklist | Responsible Scaling / safety policy | Gemini safety controls / policy | AI safety, acceptable-use, ethics, risk-boundary copy, crawler policy audit |
| Quản trị dữ liệu | Data controls / privacy controls | privacy and data handling docs | Gemini API data governance references | privacy, ai-data-governance, KB/TM source tracking, SHA-256 hashes |
| Giám sát và phát hành | production checklist / eval discipline | system-card transparency discipline | model/version documentation discipline | deploy.js, status.html, SLA report, trust-pages-machine-audit, sitemap/hreflang audits |
- Nguồn: data/state-machine/model-card.json, public-bench.json, trust-pages.json, security-headers.json.
- Nguồn: data/trust-pages-machine-audit.json, data/discovery-surface-audit.json, data/ai-answer-readiness-audit.json.
- Nguồn: data/kb-machine-audit.json, data/tm/quality-audit-report.json, data/sla-report.json.
- Ngày kiểm tra tài liệu đối chiếu chính thức: 2026-08-19; liên kết được liệt kê trong bảng đối chiếu OpenAI / Anthropic / Google Gemini.
Trọng tâm của V2.0 không phải là thêm tính từ, mà là tách rõ "đã triển khai" và "chưa triển khai": việc sử dụng production, đối chiếu quản trị, bất thường trạng thái, ký GPG và vi phạm SLA đều được công khai đúng theo dữ liệu nguồn.
Toàn vẹn Phát hành và GPG
Đã cấu hình ký GPG cục bộ. signingkey=0934DFA0EDA6363A. Đang chờ xác minh trên GitHub cho đến khi tải lên khóa công khai và xác nhận huy hiệu Verified.
Đối chiếu OpenAI / Anthropic / Google Gemini
Tài liệu quản trị của trang được đối chiếu đồng thời với ba khung công khai: tài liệu mô hình, system card/model card, đánh giá an toàn, quản trị dữ liệu và chính sách sử dụng. Đây là đối chiếu quản trị, không phải tuyên bố rằng mọi nhà cung cấp đều đã dùng cho production inference. Ngày kiểm tra tài liệu chính thức: 2026-08-19
| Nhà cung cấp đối chiếu | Trọng tâm quản trị | Công khai của Starnum | Nguồn chính thức |
|---|---|---|---|
| OpenAI | Tài liệu mô hình, ghi chú mô hình mới nhất, thực hành an toàn tốt nhất và kiểm soát dữ liệu. | Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị. | https://platform.openai.com/docs/models |
| Anthropic | Tài liệu mô hình Claude, system card/model card, Responsible Scaling và chính sách an toàn. | Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị. | https://docs.anthropic.com/en/docs/about-claude/models |
| Google Gemini | Tài liệu mô hình Gemini API, cài đặt an toàn, quản trị dữ liệu và chính sách nền tảng. | Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị. | https://ai.google.dev/gemini-api/docs/models |