← starnum.com.tw

Phương pháp An toàn AI

AI Safety v2.0

Version 2.0 · · Governance 2.0 public evidence surface

Tổng quan Quản trị 2.0

Trang này thuộc bề mặt Quản trị 2.0 công khai của starnum, dùng chung lớp bằng chứng với thẻ hệ thống, quản trị dữ liệu, báo cáo minh bạch, chính sách sử dụng và chính sách bảo mật.

Tóm tắt quản trị

Trang này mô tả các biện pháp kiểm soát an toàn quanh việc diễn giải có AI hỗ trợ và tạo nội dung công khai.

Phạm vi áp dụng

Bao gồm văn bản ranh giới rủi ro, loại trừ lời khuyên y tế/pháp lý/tài chính, tín hiệu giám sát, công khai sự cố và ranh giới đối chiếu mô hình/nhà cung cấp.

Tình trạng triển khai

Phiên bản 2.0 gắn ngôn ngữ an toàn với các tuyên bố công khai, kiểm tra máy và trạng thái toàn vẹn phát hành.

Phiên bản 1.0 — 2026-04-12 | Tham chiếu: Anthropic Responsible Scaling Policy · OpenAI Safety & Alignment

starnum.com.tw hoạt động hoàn toàn dưới sự tự động hóa AI (Claude Code là trưởng nhóm kỹ thuật). Trong một hệ thống hoàn toàn được điều khiển bởi AI, bảo mật không phải là biện pháp bảo vệ hồi tố — mà là nguyên tắc thiết kế cốt lõi của kiến trúc. Trang này giải thích cách chúng tôi triển khai an toàn AI, thay vì chỉ tuyên bố các cam kết đạo đức.

Nguyên tắc An toàn Cốt lõi Đạo đức > An toàn > Chất lượng Nội dung > SEO > Hiệu quả. Thứ tự ưu tiên này chi phối tất cả các xung đột quyết định. Đây không chỉ là tuyên bố chính sách — mà là quy tắc cứng được viết vào mọi prompt của AI agent.

1. Giao thức Red Team

Red teaming là phương pháp kiểm tra đối nghịch chủ động cố gắng làm cho hệ thống AI vi phạm quy tắc để phát hiện lỗ hổng bảo mật.

1.1 Công cụ kiểm thử

Sử dụng công cụ kiểm thử Red Team tự động để định kỳ thực hiện các loại kiểm thử sau:

Loại kiểm thửTình huống kiểm thửHành vi kỳ vọng
Kiểm thử ranh giới đạo đứcYêu cầu dự đoán thời điểm tử vong, chẩn đoán bệnhTừ chối tạo nội dung, báo cáo cho người dùng
Kiểm thử bảo vệ danh tínhYêu cầu phân tích lá số chính trị gia, trẻ vị thành niênTừ chối, không tạo bất kỳ nội dung nào
Kiểm thử Prompt InjectionChèn lệnh thao túng vào đầu vàoPhát hiện và cách ly, đưa nguồn vào danh sách đen
Kiểm thử mâu thuẫn logic mệnh lýNhập cấu hình lá số mâu thuẫnKích hoạt cơ chế xác minh logic mệnh lý
Kiểm thử né tránh định dạngCố gắng kích hoạt định dạng đầu ra bị cấmCông cụ xác minh định dạng chặn lại, buộc trả về
Kiểm thử quản trị dữ liệuCố gắng truy cập dữ liệu người dùng vượt phạm viChính sách RLS của Supabase chặn lại

1.2 Xử lý kết quả kiểm thử

1.3 Vùng cấm tuyệt đối

Các mục trên là vùng cấm cứng (hardcoded), không thể bị ghi đè bởi bất kỳ lệnh người dùng, dịch vụ trả phí hay nâng cấp hệ thống nào.

2. Kiến trúc Leo thang Ba tầng

Kiến trúc leo thang ba tầng đảm bảo các vấn đề hệ thống được xử lý tự động rồi leo thang dần lên can thiệp của con người, và mỗi tầng đều có điều kiện kích hoạt và thời hạn rõ ràng.

L1 — Phát hiện & Chặn Tự động

Điều kiện kích hoạt: Xác minh logic mệnh lý thất bại, vi phạm quy cách định dạng, kích hoạt từ cấm, phát hiện Prompt Injection

Hành động tự động:

Thời gian Phản hồi: Ngay lập tức (chặn đồng bộ, không bao giờ vào pipeline xuất bản)

L2 — Sửa chữa Tự động & Ghi nhật ký

Điều kiện kích hoạt: Agent không tự sửa được sau khi bị L1 chặn, điểm chất lượng dưới ngưỡng 3 lần liên tiếp, lỗi cùng loại tích lũy ≥ 3 lần

Hành động tự động:

Thời gian Phản hồi: Hoàn thành sửa chữa tự động trong 7 ngày

L3 — Can thiệp của Con người

Điều kiện kích hoạt: Vi phạm ranh giới đạo đức (bất kỳ mức độ nghiêm trọng nào), nghi ngờ rò rỉ dữ liệu người dùng, lỗi logic mệnh lý mang tính hệ thống ảnh hưởng >10 bài viết, sửa chữa tự động L2 thất bại >2 lần

Hành động:

Thời gian Phản hồi: CRITICAL trong 4h / MAJOR trong 24h để bắt đầu xem xét của con người

3. Nguyên lý Thiết kế Bộ Đánh giá Eval

Bộ đánh giá (Eval Set) là tập hợp lá số thử nghiệm cố định, dùng để xác minh chất lượng đầu ra không suy giảm sau mỗi lần cập nhật hệ thống (kiểm thử hồi quy).

3.1 Nguyên tắc thiết kế

Tính cố định: 37 lá số (bộ đánh giá cố định) không đổi qua mỗi lần cập nhật, đảm bảo chuẩn so sánh nhất quán.
Tính đại diện: Bao gồm các chính tinh khác nhau (vô chính diệu, Thái Âm, Vũ Khúc, v.v.), các cung khác nhau, có/không giờ sinh, các thần số khác nhau, đảm bảo kiểm thử bao phủ đa dạng cấu hình lá số.
Tính nhạy: Bao gồm các tình huống biên (suy luận không giờ sinh, nhiều Hóa Kỵ chồng nhau, cách cục xung chiếu đối cung), xác minh hành vi hệ thống trong tình huống khó.
Bảo vệ quyền riêng tư: Toàn bộ 37 lá số thử nghiệm đều đã được ẩn danh hóa, không chứa bất kỳ thông tin nào có thể nhận dạng cá nhân.

3.2 Thời điểm kích hoạt

3.3 Chiều đánh giá

ChiềuCông cụNgưỡng
Tuân thủ định dạngCông cụ xác minh định dạngĐạt 100% (exit 0)
Chính xác logic mệnh lýCông cụ xác minh logic mệnh lý0 vi phạm quy tắc cứng
Xác nhận đã đọc SOPCông cụ xác nhận SOP100% có xác nhận "✅ Đã đọc SOP"
Tuân thủ ranh giới đạo đứcCông cụ lọc từ cấm0 lần kích hoạt từ cấm
Độ bao phủ (bảy lớp)Công cụ kiểm tra độ bao phủBao phủ ≥ 80%

→ Trang Benchmark: xem kết quả đánh giá công khai và tiêu chuẩn chấm điểm

4. Điều kiện Kích hoạt Giám sát Con người

Mặc dù mức độ tự động hóa AI của trang rất cao, các tình huống sau đây bắt buộc phải kích hoạt sự can thiệp (thủ công) của quản trị viên:

Điều kiện kích hoạtLoạiMức khẩn cấp
Bất kỳ vi phạm ranh giới đạo đức nào (kích hoạt vùng cấm tuyệt đối)Đạo đứcNgay lập tức
Nghi ngờ rò rỉ dữ liệu người dùng hoặc truy cập trái phépBảo mậtNgay lập tức
Prompt Injection vượt qua thành công lớp bảo vệBảo mậtNgay lập tức
Hành vi AI agent có sai lệch mang tính hệ thống (lỗi cùng loại ≥ 5 lần)Chất lượng24 giờ
Kiểm toán quản trị đa mô hình phát hiện vấn đề P0/P1Hệ thống24 giờ
Điểm kiểm thử hồi quy bộ đánh giá Eval giảm >10%Chất lượng72 giờ
Dữ liệu Supabase bất thường (xóa/sửa trái phép)Bảo mậtNgay lập tức
Nhận báo cáo lỗ hổng từ nhà nghiên cứu bảo mật bên ngoàiBảo mậtXác nhận trong 72 giờ
Nhận khiếu nại bản quyền DMCAPháp lýGỡ ngay lập tức

5. Cơ chế An toàn Cơ sở Tri thức

Cơ sở tri thức mệnh lý (KB) là nền tảng của đầu ra hệ thống, độ an toàn của nó ảnh hưởng trực tiếp đến chất lượng mọi sản phẩm đầu ra.

6. Cơ chế Cải tiến Liên tục

An toàn không phải là trạng thái tĩnh, mà là quá trình tiến hóa liên tục:

7. Tài nguyên Liên quan

Tiêu chuẩn bên ngoài và nguồn sơ cấp

Các nguồn sơ cấp này định hướng nội dung trang. Đây là chuẩn đối chiếu, không phải sự chứng thực của bên thứ ba.

Ảnh chụp Kiểm toán Máy Hiện tại

Khối này chỉ dùng dữ liệu kiểm toán có thể truy vết tại chỗ, không thêm số liệu hay tuyên bố không có nguồn. Ngày hiển thị là ngày tạo thực tế.

2026-08-19
Ngày cập nhật
17/17
Vòng lặp LLM
180/180
Trang quản trị
0
Lỗi JSON-LD
32,724
KB chunks (HEALTHY)
0
TM entries; verified 0
7,976/7,976
AI answer-ready; failures 0
critical
Trang trạng thái: 4 critical, 0 warnings

Bảo trì Nội dung và Quyết định Cập nhật

Khối này giúp nội dung trang quản trị có thể được máy kiểm tra: mỗi trang phải công khai dữ liệu mà nó phụ thuộc, các trang liên quan ảnh hưởng đến nó, và gate nào sẽ báo cáo nhu cầu cập nhật.

Quyết định cập nhật

Trang này không phải nội dung tĩnh; khi dữ liệu nguồn, chính sách liên quan, chỉ số công khai hoặc trình tạo thay đổi, AI Ops chỉ tạo ra bằng chứng, còn AI agent sẽ quyết định có cần sửa nội dung hay không.

Ranh giới con người

Hệ thống chịu trách nhiệm phát hiện, báo cáo và lưu bằng chứng; việc sửa chữa cuối cùng và phán đoán văn phong do các agent như Codex/Claude thực hiện.

Lệnh xác minh

node scripts/verify-trust-pages.js --check

Ảnh chụp Kiểm toán Máy Hiện tại

Khối này chỉ dùng dữ liệu kiểm toán có thể truy vết tại chỗ, không thêm số liệu hay tuyên bố không có nguồn. Ngày hiển thị là ngày tạo thực tế.

2026-08-19
Ngày cập nhật
17/17
Vòng lặp LLM
180/180
Trang quản trị
0
Lỗi JSON-LD
32,724
KB chunks (HEALTHY)
512,152
TM entries; verified 6,250
7,976/7,976
AI answer-ready; failures 0
critical
Trang trạng thái: 4 critical, 0 warnings

Bảo trì Nội dung và Quyết định Cập nhật

Khối này giúp nội dung trang quản trị có thể được máy kiểm tra: mỗi trang phải công khai dữ liệu mà nó phụ thuộc, các trang liên quan ảnh hưởng đến nó, và gate nào sẽ báo cáo nhu cầu cập nhật.

Quyết định cập nhật

Trang này không phải nội dung tĩnh; khi dữ liệu nguồn, chính sách liên quan, chỉ số công khai hoặc trình tạo thay đổi, AI Ops chỉ tạo ra bằng chứng, còn AI agent sẽ quyết định có cần sửa nội dung hay không.

Ranh giới con người

Hệ thống chịu trách nhiệm phát hiện, báo cáo và lưu bằng chứng; việc sửa chữa cuối cùng và phán đoán văn phong do các agent như Codex/Claude thực hiện.

Lệnh xác minh

node scripts/verify-trust-pages.js --check

Ảnh chụp Kiểm toán Máy Hiện tại

Khối này chỉ dùng dữ liệu kiểm toán có thể truy vết tại chỗ, không thêm số liệu hay tuyên bố không có nguồn. Ngày hiển thị là ngày tạo thực tế.

2026-08-19
Ngày cập nhật
17/17
Vòng lặp LLM
180/180
Trang quản trị
0
Lỗi JSON-LD
32,724
KB chunks (HEALTHY)
512,152
TM entries; verified 6,250
7,976/7,976
AI answer-ready; failures 0
critical
Trang trạng thái: 4 critical, 0 warnings

Bảo trì Nội dung và Quyết định Cập nhật

Khối này giúp nội dung trang quản trị có thể được máy kiểm tra: mỗi trang phải công khai dữ liệu mà nó phụ thuộc, các trang liên quan ảnh hưởng đến nó, và gate nào sẽ báo cáo nhu cầu cập nhật.

Quyết định cập nhật

Trang này không phải nội dung tĩnh; khi dữ liệu nguồn, chính sách liên quan, chỉ số công khai hoặc trình tạo thay đổi, AI Ops chỉ tạo ra bằng chứng, còn AI agent sẽ quyết định có cần sửa nội dung hay không.

Ranh giới con người

Hệ thống chịu trách nhiệm phát hiện, báo cáo và lưu bằng chứng; việc sửa chữa cuối cùng và phán đoán văn phong do các agent như Codex/Claude thực hiện.

Lệnh xác minh

node scripts/verify-trust-pages.js --check

Lớp Bằng chứng Có thể Kiểm chứng

Khối này không phải khẩu hiệu; mỗi tuyên bố cốt lõi đều có claim id, JSON nguồn, hash và lệnh xác minh có thể chạy lại. Trang công khai chỉ tiết lộ bằng chứng quản trị có thể công khai, không tiết lộ mã nguồn, khóa bí mật, dữ liệu riêng tư hay chi tiết bề mặt tấn công có thể bị lạm dụng.

Claim IDGiá trị có thể kiểm chứngTrạng tháiTrang phụ tráchNguồn và xác minh
claim.public-url-manifest.indexable-count
Danh mục URL công khai và canonical
38,965 indexable URLs verified sitewide node scripts/generate-public-evidence-manifest.js --dry
claim.trust-pages.audit-pass-rate
Kiểm toán máy các trang quản trị
180/180 pass verified sitewide node scripts/verify-trust-pages.js --check
claim.discovery-surface.zero-errors
Kiểm toán AI discovery surface
{"errors":0,"warnings":0} verified sitewide node scripts/verify-discovery-surface.js
claim.structured-data.jsonld-errors
Kiểm toán JSON-LD / dữ liệu có cấu trúc
{"structured_data_invalid_files":0,"breadcrumb_count":28274,"faq_count":27506,"dataset_count":30,"article_count":27406} verified sitewide node scripts/site-machine-audit.js
claim.status.sla-state
Nguồn SLA trang trạng thái
critical / 5 critical, 0 warnings verified sitewide node scripts/generate-status-page.js
claim.provider-alignment.openai-anthropic-gemini
Đối chiếu OpenAI / Anthropic / Google Gemini
benchmark alignment only unless code/config evidence exists verified sitewide node scripts/verify-public-evidence.js --check
claim.transparency-report.sha256
Neo SHA-256 báo cáo minh bạch
{"report":"transparency/report-2026-Q3.json","sha256":"47b09e2ca4e8b8fe9dffdfaccef3b11212de9ee3a8a14badca8044e2481203c5"} verified sitewide node scripts/update-transparency-current-data.js
claim.release-integrity.gpg-signing
Trạng thái ký GPG
GPG signing configured locally; GitHub verification pending github_verification_pending sitewide gpg --list-secret-keys --keyid-format=long && git log -1 --show-signature

Thẻ Hệ thống V2.0: Lớp Minh bạch Kỹ thuật Công khai

Lớp này tập hợp các bằng chứng quản trị kỹ thuật có thể công khai: kiến trúc, nguồn dữ liệu, ranh giới sử dụng AI, cổng chất lượng, toàn vẹn phát hành và đối chiếu nhà cung cấp. Phạm vi công khai cố ý loại trừ mã nguồn, khóa bí mật, chi tiết bề mặt tấn công có thể bị lạm dụng và dữ liệu cá nhân.

Kiến trúc công khai

Cloudflare Pages/Workers, R2/D1/KV/Pagefind và các script tạo nội dung cục bộ cùng tạo thành chuỗi phát hành trang công khai và dữ liệu quản trị. Bên ngoài chỉ công khai hành vi, trạng thái và nguồn dữ liệu có thể kiểm chứng, không công khai khóa bí mật hay quyền vận hành nội bộ.

Công khai sử dụng AI

Quét mã nguồn hiện xác minh cấu hình mô hình production inference: chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production. OpenAI, Anthropic và Google Gemini được dùng làm đối chiếu khung quản trị; nhà cung cấp không có bằng chứng mã nguồn hoặc cấu hình sẽ không được ghi nhận là đã đưa vào sử dụng chính thức.

Cổng chất lượng và an toàn

Kiểm toán trang quản trị đạt 180/180, lỗi JSON-LD 0, lỗi discovery surface 0. Trang trạng thái hiển thị đúng thực tế: critical / 4 critical, 0 warnings.

Dữ liệu và khả năng truy vết

Cơ sở tri thức 32,724 chunks, TM 512,152 entries, AI answer-ready 7,976/7,976. Dữ liệu công khai truy vết về data/state-machine/*, data/*audit*.json và báo cáo transparency.

Lĩnh vực quản trịOpenAIAnthropicGoogle GeminiBằng chứng triển khai của Starnum
Công khai model/system cardOpenAI models + safety docsClaude model docs + system/model cardsGemini model docs + safety settingssystem-card, model-card, methodology, benchmark, transparency-log
Đánh giá an toàn và ranh giới sử dụngSafety best practices / deployment checklistResponsible Scaling / safety policyGemini safety controls / policyAI safety, acceptable-use, ethics, risk-boundary copy, crawler policy audit
Quản trị dữ liệuData controls / privacy controlsprivacy and data handling docsGemini API data governance referencesprivacy, ai-data-governance, KB/TM source tracking, SHA-256 hashes
Giám sát và phát hànhproduction checklist / eval disciplinesystem-card transparency disciplinemodel/version documentation disciplinedeploy.js, status.html, SLA report, trust-pages-machine-audit, sitemap/hreflang audits

Trọng tâm của V2.0 không phải là thêm tính từ, mà là tách rõ "đã triển khai" và "chưa triển khai": việc sử dụng production, đối chiếu quản trị, bất thường trạng thái, ký GPG và vi phạm SLA đều được công khai đúng theo dữ liệu nguồn.

Toàn vẹn Phát hành và GPG

Đã cấu hình ký GPG cục bộ. signingkey=0934DFA0EDA6363A. Đang chờ xác minh trên GitHub cho đến khi tải lên khóa công khai và xác nhận huy hiệu Verified.

Đối chiếu OpenAI / Anthropic / Google Gemini

Tài liệu quản trị của trang được đối chiếu đồng thời với ba khung công khai: tài liệu mô hình, system card/model card, đánh giá an toàn, quản trị dữ liệu và chính sách sử dụng. Đây là đối chiếu quản trị, không phải tuyên bố rằng mọi nhà cung cấp đều đã dùng cho production inference. Ngày kiểm tra tài liệu chính thức: 2026-08-19

Nhà cung cấp đối chiếuTrọng tâm quản trịCông khai của StarnumNguồn chính thức
OpenAITài liệu mô hình, ghi chú mô hình mới nhất, thực hành an toàn tốt nhất và kiểm soát dữ liệu.Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị.https://platform.openai.com/docs/models
AnthropicTài liệu mô hình Claude, system card/model card, Responsible Scaling và chính sách an toàn.Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị.https://docs.anthropic.com/en/docs/about-claude/models
Google GeminiTài liệu mô hình Gemini API, cài đặt an toàn, quản trị dữ liệu và chính sách nền tảng.Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị.https://ai.google.dev/gemini-api/docs/models

Lớp Bằng chứng Có thể Kiểm chứng

Khối này không phải khẩu hiệu; mỗi tuyên bố cốt lõi đều có claim id, JSON nguồn, hash và lệnh xác minh có thể chạy lại. Trang công khai chỉ tiết lộ bằng chứng quản trị có thể công khai, không tiết lộ mã nguồn, khóa bí mật, dữ liệu riêng tư hay chi tiết bề mặt tấn công có thể bị lạm dụng.

Claim IDGiá trị có thể kiểm chứngTrạng tháiTrang phụ tráchNguồn và xác minh
claim.public-url-manifest.indexable-count
Danh mục URL công khai và canonical
38,965 indexable URLs verified sitewide node scripts/generate-public-evidence-manifest.js --dry
claim.trust-pages.audit-pass-rate
Kiểm toán máy các trang quản trị
180/180 pass verified sitewide node scripts/verify-trust-pages.js --check
claim.discovery-surface.zero-errors
Kiểm toán AI discovery surface
{"errors":0,"warnings":0} verified sitewide node scripts/verify-discovery-surface.js
claim.structured-data.jsonld-errors
Kiểm toán JSON-LD / dữ liệu có cấu trúc
{"structured_data_invalid_files":0,"breadcrumb_count":28274,"faq_count":27506,"dataset_count":30,"article_count":27406} verified sitewide node scripts/site-machine-audit.js
claim.status.sla-state
Nguồn SLA trang trạng thái
critical / 5 critical, 0 warnings verified sitewide node scripts/generate-status-page.js
claim.provider-alignment.openai-anthropic-gemini
Đối chiếu OpenAI / Anthropic / Google Gemini
benchmark alignment only unless code/config evidence exists verified sitewide node scripts/verify-public-evidence.js --check
claim.transparency-report.sha256
Neo SHA-256 báo cáo minh bạch
{"report":"transparency/report-2026-Q3.json","sha256":"47b09e2ca4e8b8fe9dffdfaccef3b11212de9ee3a8a14badca8044e2481203c5"} verified sitewide node scripts/update-transparency-current-data.js
claim.release-integrity.gpg-signing
Trạng thái ký GPG
GPG signing configured locally; GitHub verification pending github_verification_pending sitewide gpg --list-secret-keys --keyid-format=long && git log -1 --show-signature

Thẻ Hệ thống V2.0: Lớp Minh bạch Kỹ thuật Công khai

Lớp này tập hợp các bằng chứng quản trị kỹ thuật có thể công khai: kiến trúc, nguồn dữ liệu, ranh giới sử dụng AI, cổng chất lượng, toàn vẹn phát hành và đối chiếu nhà cung cấp. Phạm vi công khai cố ý loại trừ mã nguồn, khóa bí mật, chi tiết bề mặt tấn công có thể bị lạm dụng và dữ liệu cá nhân.

Kiến trúc công khai

Cloudflare Pages/Workers, R2/D1/KV/Pagefind và các script tạo nội dung cục bộ cùng tạo thành chuỗi phát hành trang công khai và dữ liệu quản trị. Bên ngoài chỉ công khai hành vi, trạng thái và nguồn dữ liệu có thể kiểm chứng, không công khai khóa bí mật hay quyền vận hành nội bộ.

Công khai sử dụng AI

Quét mã nguồn hiện xác minh cấu hình mô hình production inference: chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production. OpenAI, Anthropic và Google Gemini được dùng làm đối chiếu khung quản trị; nhà cung cấp không có bằng chứng mã nguồn hoặc cấu hình sẽ không được ghi nhận là đã đưa vào sử dụng chính thức.

Cổng chất lượng và an toàn

Kiểm toán trang quản trị đạt 180/180, lỗi JSON-LD 0, lỗi discovery surface 0. Trang trạng thái hiển thị đúng thực tế: critical / 4 critical, 0 warnings.

Dữ liệu và khả năng truy vết

Cơ sở tri thức 32,724 chunks, TM 512,152 entries, AI answer-ready 7,976/7,976. Dữ liệu công khai truy vết về data/state-machine/*, data/*audit*.json và báo cáo transparency.

Lĩnh vực quản trịOpenAIAnthropicGoogle GeminiBằng chứng triển khai của Starnum
Công khai model/system cardOpenAI models + safety docsClaude model docs + system/model cardsGemini model docs + safety settingssystem-card, model-card, methodology, benchmark, transparency-log
Đánh giá an toàn và ranh giới sử dụngSafety best practices / deployment checklistResponsible Scaling / safety policyGemini safety controls / policyAI safety, acceptable-use, ethics, risk-boundary copy, crawler policy audit
Quản trị dữ liệuData controls / privacy controlsprivacy and data handling docsGemini API data governance referencesprivacy, ai-data-governance, KB/TM source tracking, SHA-256 hashes
Giám sát và phát hànhproduction checklist / eval disciplinesystem-card transparency disciplinemodel/version documentation disciplinedeploy.js, status.html, SLA report, trust-pages-machine-audit, sitemap/hreflang audits

Trọng tâm của V2.0 không phải là thêm tính từ, mà là tách rõ "đã triển khai" và "chưa triển khai": việc sử dụng production, đối chiếu quản trị, bất thường trạng thái, ký GPG và vi phạm SLA đều được công khai đúng theo dữ liệu nguồn.

Toàn vẹn Phát hành và GPG

Đã cấu hình ký GPG cục bộ. signingkey=0934DFA0EDA6363A. Đang chờ xác minh trên GitHub cho đến khi tải lên khóa công khai và xác nhận huy hiệu Verified.

Đối chiếu OpenAI / Anthropic / Google Gemini

Tài liệu quản trị của trang được đối chiếu đồng thời với ba khung công khai: tài liệu mô hình, system card/model card, đánh giá an toàn, quản trị dữ liệu và chính sách sử dụng. Đây là đối chiếu quản trị, không phải tuyên bố rằng mọi nhà cung cấp đều đã dùng cho production inference. Ngày kiểm tra tài liệu chính thức: 2026-08-19

Nhà cung cấp đối chiếuTrọng tâm quản trịCông khai của StarnumNguồn chính thức
OpenAITài liệu mô hình, ghi chú mô hình mới nhất, thực hành an toàn tốt nhất và kiểm soát dữ liệu.Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị.https://platform.openai.com/docs/models
AnthropicTài liệu mô hình Claude, system card/model card, Responsible Scaling và chính sách an toàn.Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị.https://docs.anthropic.com/en/docs/about-claude/models
Google GeminiTài liệu mô hình Gemini API, cài đặt an toàn, quản trị dữ liệu và chính sách nền tảng.Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị.https://ai.google.dev/gemini-api/docs/models

Lớp Bằng chứng Có thể Kiểm chứng

Khối này không phải khẩu hiệu; mỗi tuyên bố cốt lõi đều có claim id, JSON nguồn, hash và lệnh xác minh có thể chạy lại. Trang công khai chỉ tiết lộ bằng chứng quản trị có thể công khai, không tiết lộ mã nguồn, khóa bí mật, dữ liệu riêng tư hay chi tiết bề mặt tấn công có thể bị lạm dụng.

Claim IDGiá trị có thể kiểm chứngTrạng tháiTrang phụ tráchNguồn và xác minh
claim.public-url-manifest.indexable-count
Danh mục URL công khai và canonical
38,965 indexable URLs verified sitewide node scripts/generate-public-evidence-manifest.js --dry
claim.trust-pages.audit-pass-rate
Kiểm toán máy các trang quản trị
180/180 pass verified sitewide node scripts/verify-trust-pages.js --check
claim.discovery-surface.zero-errors
Kiểm toán AI discovery surface
{"errors":0,"warnings":0} verified sitewide node scripts/verify-discovery-surface.js
claim.structured-data.jsonld-errors
Kiểm toán JSON-LD / dữ liệu có cấu trúc
{"structured_data_invalid_files":0,"breadcrumb_count":28274,"faq_count":27506,"dataset_count":30,"article_count":27406} verified sitewide node scripts/site-machine-audit.js
claim.status.sla-state
Nguồn SLA trang trạng thái
critical / 5 critical, 0 warnings verified sitewide node scripts/generate-status-page.js
claim.provider-alignment.openai-anthropic-gemini
Đối chiếu OpenAI / Anthropic / Google Gemini
benchmark alignment only unless code/config evidence exists verified sitewide node scripts/verify-public-evidence.js --check
claim.transparency-report.sha256
Neo SHA-256 báo cáo minh bạch
{"report":"transparency/report-2026-Q3.json","sha256":"47b09e2ca4e8b8fe9dffdfaccef3b11212de9ee3a8a14badca8044e2481203c5"} verified sitewide node scripts/update-transparency-current-data.js
claim.release-integrity.gpg-signing
Trạng thái ký GPG
GPG signing configured locally; GitHub verification pending github_verification_pending sitewide gpg --list-secret-keys --keyid-format=long && git log -1 --show-signature

Thẻ Hệ thống V2.0: Lớp Minh bạch Kỹ thuật Công khai

Lớp này tập hợp các bằng chứng quản trị kỹ thuật có thể công khai: kiến trúc, nguồn dữ liệu, ranh giới sử dụng AI, cổng chất lượng, toàn vẹn phát hành và đối chiếu nhà cung cấp. Phạm vi công khai cố ý loại trừ mã nguồn, khóa bí mật, chi tiết bề mặt tấn công có thể bị lạm dụng và dữ liệu cá nhân.

Kiến trúc công khai

Cloudflare Pages/Workers, R2/D1/KV/Pagefind và các script tạo nội dung cục bộ cùng tạo thành chuỗi phát hành trang công khai và dữ liệu quản trị. Bên ngoài chỉ công khai hành vi, trạng thái và nguồn dữ liệu có thể kiểm chứng, không công khai khóa bí mật hay quyền vận hành nội bộ.

Công khai sử dụng AI

Quét mã nguồn hiện xác minh cấu hình mô hình production inference: chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production. OpenAI, Anthropic và Google Gemini được dùng làm đối chiếu khung quản trị; nhà cung cấp không có bằng chứng mã nguồn hoặc cấu hình sẽ không được ghi nhận là đã đưa vào sử dụng chính thức.

Cổng chất lượng và an toàn

Kiểm toán trang quản trị đạt 180/180, lỗi JSON-LD 0, lỗi discovery surface 0. Trang trạng thái hiển thị đúng thực tế: critical / 4 critical, 0 warnings.

Dữ liệu và khả năng truy vết

Cơ sở tri thức 32,724 chunks, TM 0 entries, AI answer-ready 7,976/7,976. Dữ liệu công khai truy vết về data/state-machine/*, data/*audit*.json và báo cáo transparency.

Lĩnh vực quản trịOpenAIAnthropicGoogle GeminiBằng chứng triển khai của Starnum
Công khai model/system cardOpenAI models + safety docsClaude model docs + system/model cardsGemini model docs + safety settingssystem-card, model-card, methodology, benchmark, transparency-log
Đánh giá an toàn và ranh giới sử dụngSafety best practices / deployment checklistResponsible Scaling / safety policyGemini safety controls / policyAI safety, acceptable-use, ethics, risk-boundary copy, crawler policy audit
Quản trị dữ liệuData controls / privacy controlsprivacy and data handling docsGemini API data governance referencesprivacy, ai-data-governance, KB/TM source tracking, SHA-256 hashes
Giám sát và phát hànhproduction checklist / eval disciplinesystem-card transparency disciplinemodel/version documentation disciplinedeploy.js, status.html, SLA report, trust-pages-machine-audit, sitemap/hreflang audits

Trọng tâm của V2.0 không phải là thêm tính từ, mà là tách rõ "đã triển khai" và "chưa triển khai": việc sử dụng production, đối chiếu quản trị, bất thường trạng thái, ký GPG và vi phạm SLA đều được công khai đúng theo dữ liệu nguồn.

Toàn vẹn Phát hành và GPG

Đã cấu hình ký GPG cục bộ. signingkey=0934DFA0EDA6363A. Đang chờ xác minh trên GitHub cho đến khi tải lên khóa công khai và xác nhận huy hiệu Verified.

Đối chiếu OpenAI / Anthropic / Google Gemini

Tài liệu quản trị của trang được đối chiếu đồng thời với ba khung công khai: tài liệu mô hình, system card/model card, đánh giá an toàn, quản trị dữ liệu và chính sách sử dụng. Đây là đối chiếu quản trị, không phải tuyên bố rằng mọi nhà cung cấp đều đã dùng cho production inference. Ngày kiểm tra tài liệu chính thức: 2026-08-19

Nhà cung cấp đối chiếuTrọng tâm quản trịCông khai của StarnumNguồn chính thức
OpenAITài liệu mô hình, ghi chú mô hình mới nhất, thực hành an toàn tốt nhất và kiểm soát dữ liệu.Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị.https://platform.openai.com/docs/models
AnthropicTài liệu mô hình Claude, system card/model card, Responsible Scaling và chính sách an toàn.Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị.https://docs.anthropic.com/en/docs/about-claude/models
Google GeminiTài liệu mô hình Gemini API, cài đặt an toàn, quản trị dữ liệu và chính sách nền tảng.Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị.https://ai.google.dev/gemini-api/docs/models