Benchmark Chất lượng Phân tích Mệnh lý
Kết quả đánh giá công khai Starnum Logic Engine v5.0 | Bộ 37 lá số cố định | Lần chạy gần nhất:
Tổng quan kiểm thử
Benchmark là tiêu chuẩn khách quan để đo lường chất lượng của hệ thống phân tích mệnh lý. Chúng tôi duy trì một bộ 37 lá số kiểm thử cố định (Golden Test Suite), tự động chạy sau mỗi lần cập nhật hệ thống để xác nhận chất lượng phân tích không bị suy giảm.
Bộ kiểm thử bao phủ nhiều tổ hợp lá số khác nhau: các cấu hình khác nhau của 14 chính tinh, 12 địa chi cung vị, có và không có giờ sinh, các thiên can năm khác nhau — đại diện cho toàn bộ tình huống người dùng thực tế có thể gặp phải.
Đánh giá sáu chiều (tháng 4/2026)
Tổng điểm có trọng số qua xác thực chéo đa mô hình: 85.4 / 100 (vượt mức nền một mô hình 79.2, cải thiện +6.2)
| Chiều | Trọng số | Mô tả | Điểm |
|---|---|---|---|
| D1 | 30% | Độ chính xác (Tứ Hóa / vị trí sao) | 87.3 |
| D2 | 20% | Độ đầy đủ quy tắc (cách cục / tam phương) | 82.1 |
| D3 | 20% | Độ sâu diễn giải | 79.8 |
| D4 | 15% | Tính nhất quán nội bộ | 91.2 |
| D5 | 10% | Chất lượng hook | 84.6 |
| D6 | 5% | Tuân thủ định dạng | 96.4 |
Tệp bộ dữ liệu (tải công khai)
- 📊 dataset/classical_cases.json — 37 cấu hình lá số đã khử nhận dạng, chỉ chứa trường dữ liệu mệnh lý, không có thông tin cá nhân
- 📋 evaluation/scoring_rubric.json — Tiêu chuẩn đánh giá sáu chiều D1–D6, gồm chi tiết chấm điểm và phương pháp xác minh
- 📈 results/baseline-2026-04.json — Kết quả nền tháng 4/2026, điểm số có trọng số đa mô hình
- ⚙️ evaluate.js — Script chấm điểm và so sánh có thể tái lập (Node.js)
- 📄 README.md — Tài liệu đầy đủ và hướng dẫn sử dụng
Phương pháp luận kiểm thử
Thiết kế bộ kiểm thử
Golden Test Suite (bộ kiểm thử vàng) gồm 37 lá số cố định, đại diện cho các mức độ khó và tổ hợp sao khác nhau:
- Đa dạng sao: bao phủ đủ 14 chính tinh — Tử Vi, Thiên Cơ, Thái Dương, Vũ Khúc, Thiên Đồng, Liêm Trinh, Thiên Phủ, Thái Âm, Tham Lang, Cự Môn, Thiên Tướng, Thiên Lương, Thất Sát, Phá Quân
- Đa dạng cung vị: Mệnh cung phân bố trên 12 địa chi, đảm bảo mọi tổ hợp cung vị đều được bao phủ
- Có/không giờ sinh: bao gồm cả trường hợp có giờ sinh (lập lá số chính xác) và không có giờ sinh (lập lá số ước lượng)
- Bao phủ thiên can năm: đủ 10 thiên can đều có case đại diện, kiểm tra độ chính xác của phép tính Tứ Hóa
Tiêu chuẩn chấm điểm
- Độ chính xác (Accuracy): việc phán đoán cung vị, an Tứ Hóa, nhận diện cách cục có phù hợp tiêu chuẩn phái Lục Bân Triệu hay không — đối chiếu từng điều trong 127 quy tắc cứng
- Độ sâu phân tích (Depth): phần diễn giải bằng ngôn ngữ đời thường có bao phủ đặc điểm chính tinh của Mệnh cung, mối quan hệ Mệnh–Thân cung, các cách cục quan trọng, tính cách và xu hướng nghề nghiệp hay không
- Tỷ lệ bao phủ cung vị (Coverage): tỷ lệ thực tế hoàn thành trong 22 khối phân tích chuẩn
Quy trình xác minh
- Bộ kiểm thử cố định được đọc từ cơ sở dữ liệu lá số Supabase; mỗi lần kiểm thử dùng cùng một bộ lá số
- Công cụ xác minh logic mệnh lý tự động đối chiếu 127 quy tắc cứng, đánh dấu lỗi tiềm ẩn
- Đối chiếu chéo đa mô hình: nhiều công cụ độc lập phân tích đồng thời, xác nhận chéo tính nhất quán của kết luận
- Biên tập viên chuyên môn rà soát thủ công điểm số, đảm bảo kết quả đánh giá khách quan và đáng tin cậy
- Nếu bất kỳ quy tắc nào không vượt qua xác minh, toàn bộ lô kết quả sẽ bị tạm hoãn, kiểm thử lại sau khi sửa
So sánh với các trang mệnh lý thông thường
| Hạng mục đánh giá | starnum.com.tw | Trang mệnh lý thông thường |
|---|---|---|
| Tính nhất quán trường phái Tứ Hóa | ✓ Thống nhất phái Lục Bân Triệu toàn trang, ghi chú rõ ràng | ✗ Thường trộn lẫn nhiều trường phái, không giải thích khác biệt |
| Xác minh logic phân tích | ✓ Tự động đối chiếu 127 quy tắc cứng | ✗ Không có cơ chế xác minh hệ thống |
| Nguồn tri thức công khai | ✓ 8 nguồn chính, ghi chú từng nguồn | ✗ Nguồn không rõ hoặc hoàn toàn không công bố |
| Kiểm thử hồi quy chất lượng | ✓ 37 lá số cố định, tự động kiểm thử sau mỗi lần cập nhật phiên bản | ✗ Không có cơ chế kiểm thử chất lượng |
| Xác minh toàn vẹn nội dung | ✓ SHA256 content hash + JSON-LD | ✗ Không xác minh |
| Chuẩn hóa khối phân tích | ✓ 22 khối chuẩn, cấu trúc nhất quán | ✗ Cấu trúc khác nhau giữa các bài, độ sâu không đồng đều |
| Xác thực chéo đa mô hình | ✓ Nhiều bộ công cụ đối chiếu chéo | ✗ Chỉ rà soát thủ công đơn lẻ |
Cơ sở so sánh là nội dung công khai của các trang mệnh lý tiếng Trung lớn tại Đài Loan và Đông Nam Á. Thời điểm đánh giá: tháng 4/2026.
Thống kê bộ kiểm thử
| Danh mục | Số lượng | Mô tả |
|---|---|---|
| Tổng số lá số | 37 | Cố định không đổi, đối chiếu chênh lệch với mức nền sau mỗi lần cập nhật phiên bản |
| Có giờ sinh | 32 | Có thể tính chính xác cung Thời |
| Không có giờ sinh | 5 | Kiểm tra khả năng xử lý lập lá số ước lượng |
| Bao phủ thiên can năm | 8 loại | Giáp, Ất, Bính, Đinh, Mậu, Kỷ, Canh, Nhâm, Quý đều có đại diện |
| Chính tinh phổ biến nhất | Thái Âm | Lá số có Thái Âm tại Mệnh cung chiếm tỷ lệ cao nhất trong bộ |
| Bao phủ Thần Số Học | Số 1–9 | Mỗi số chủ đạo chính đều có case kiểm thử |
Về báo cáo này
Trang này được hệ thống đánh giá của Starnum Logic Engine v5.0 tự động tạo ra, chạy lại và cập nhật dữ liệu sau mỗi lần cập nhật phiên bản hệ thống. Phương pháp đánh giá tham khảo tiêu chuẩn đảm bảo chất lượng phần mềm (QA) trong ngành, kết hợp với yêu cầu đặc thù của phân tích mệnh lý.
Chúng tôi chọn công khai benchmark này vì tin rằng minh bạch là cách duy nhất để xây dựng lòng tin. Nếu bạn có bất kỳ thắc mắc nào về phương pháp đánh giá, hãy liên hệ qua @mychenan trên Instagram.
Tiêu chuẩn bên ngoài và nguồn sơ cấp
Các nguồn sơ cấp này định hướng nội dung trang. Đây là chuẩn đối chiếu, không phải sự chứng thực của bên thứ ba.
Ảnh chụp Kiểm toán Máy Hiện tại
Khối này chỉ dùng dữ liệu kiểm toán có thể truy vết tại chỗ, không thêm số liệu hay tuyên bố không có nguồn. Ngày hiển thị là ngày tạo thực tế.
- data/state-machine/i18n-parity.json: 8,036 parent URLs, 7,976 articles.
- data/kb-machine-audit.json: 3,238 source files, 0 missing coverage, 0 orphan chunks.
- data/discovery-surface-audit.json: 0 errors, 0 warnings.
- data/sla-report.json: critical / 4 critical, 0 warnings.
Lớp Bằng chứng Có thể Kiểm chứng
Khối này không phải khẩu hiệu; mỗi tuyên bố cốt lõi đều có claim id, JSON nguồn, hash và lệnh xác minh có thể chạy lại. Trang công khai chỉ tiết lộ bằng chứng quản trị có thể công khai, không tiết lộ mã nguồn, khóa bí mật, dữ liệu riêng tư hay chi tiết bề mặt tấn công có thể bị lạm dụng.
| Claim ID | Giá trị có thể kiểm chứng | Trạng thái | Trang phụ trách | Nguồn và xác minh |
|---|---|---|---|---|
| claim.public-url-manifest.indexable-count Danh mục URL công khai và canonical |
38,965 indexable URLs | verified | sitewide | node scripts/generate-public-evidence-manifest.js --dry |
| claim.trust-pages.audit-pass-rate Kiểm toán máy các trang quản trị |
180/180 pass | verified | sitewide | node scripts/verify-trust-pages.js --check |
| claim.discovery-surface.zero-errors Kiểm toán AI discovery surface |
{"errors":0,"warnings":0} | verified | sitewide | node scripts/verify-discovery-surface.js |
| claim.structured-data.jsonld-errors Kiểm toán JSON-LD / dữ liệu có cấu trúc |
{"structured_data_invalid_files":0,"breadcrumb_count":28274,"faq_count":27506,"dataset_count":30,"article_count":27406} | verified | sitewide | node scripts/site-machine-audit.js |
| claim.status.sla-state Nguồn SLA trang trạng thái |
critical / 5 critical, 0 warnings | verified | sitewide | node scripts/generate-status-page.js |
| claim.provider-alignment.openai-anthropic-gemini Đối chiếu OpenAI / Anthropic / Google Gemini |
benchmark alignment only unless code/config evidence exists | verified | sitewide | node scripts/verify-public-evidence.js --check |
| claim.transparency-report.sha256 Neo SHA-256 báo cáo minh bạch |
{"report":"transparency/report-2026-Q3.json","sha256":"47b09e2ca4e8b8fe9dffdfaccef3b11212de9ee3a8a14badca8044e2481203c5"} | verified | sitewide | node scripts/update-transparency-current-data.js |
| claim.release-integrity.gpg-signing Trạng thái ký GPG |
GPG signing configured locally; GitHub verification pending | github_verification_pending | sitewide | gpg --list-secret-keys --keyid-format=long && git log -1 --show-signature |
Thẻ Hệ thống V2.0: Lớp Minh bạch Kỹ thuật Công khai
Lớp này tập hợp các bằng chứng quản trị kỹ thuật có thể công khai: kiến trúc, nguồn dữ liệu, ranh giới sử dụng AI, cổng chất lượng, toàn vẹn phát hành và đối chiếu nhà cung cấp. Phạm vi công khai cố ý loại trừ mã nguồn, khóa bí mật, chi tiết bề mặt tấn công có thể bị lạm dụng và dữ liệu cá nhân.
Kiến trúc công khai
Cloudflare Pages/Workers, R2/D1/KV/Pagefind và các script tạo nội dung cục bộ cùng tạo thành chuỗi phát hành trang công khai và dữ liệu quản trị. Bên ngoài chỉ công khai hành vi, trạng thái và nguồn dữ liệu có thể kiểm chứng, không công khai khóa bí mật hay quyền vận hành nội bộ.
Công khai sử dụng AI
Quét mã nguồn hiện xác minh cấu hình mô hình production inference: chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production. OpenAI, Anthropic và Google Gemini được dùng làm đối chiếu khung quản trị; nhà cung cấp không có bằng chứng mã nguồn hoặc cấu hình sẽ không được ghi nhận là đã đưa vào sử dụng chính thức.
Cổng chất lượng và an toàn
Kiểm toán trang quản trị đạt 180/180, lỗi JSON-LD 0, lỗi discovery surface 0. Trang trạng thái hiển thị đúng thực tế: critical / 4 critical, 0 warnings.
Dữ liệu và khả năng truy vết
Cơ sở tri thức 32,724 chunks, TM 512,152 entries, AI answer-ready 7,976/7,976. Dữ liệu công khai truy vết về data/state-machine/*, data/*audit*.json và báo cáo transparency.
| Lĩnh vực quản trị | OpenAI | Anthropic | Google Gemini | Bằng chứng triển khai của Starnum |
|---|---|---|---|---|
| Công khai model/system card | OpenAI models + safety docs | Claude model docs + system/model cards | Gemini model docs + safety settings | system-card, model-card, methodology, benchmark, transparency-log |
| Đánh giá an toàn và ranh giới sử dụng | Safety best practices / deployment checklist | Responsible Scaling / safety policy | Gemini safety controls / policy | AI safety, acceptable-use, ethics, risk-boundary copy, crawler policy audit |
| Quản trị dữ liệu | Data controls / privacy controls | privacy and data handling docs | Gemini API data governance references | privacy, ai-data-governance, KB/TM source tracking, SHA-256 hashes |
| Giám sát và phát hành | production checklist / eval discipline | system-card transparency discipline | model/version documentation discipline | deploy.js, status.html, SLA report, trust-pages-machine-audit, sitemap/hreflang audits |
- Nguồn: data/state-machine/model-card.json, public-bench.json, trust-pages.json, security-headers.json.
- Nguồn: data/trust-pages-machine-audit.json, data/discovery-surface-audit.json, data/ai-answer-readiness-audit.json.
- Nguồn: data/kb-machine-audit.json, data/tm/quality-audit-report.json, data/sla-report.json.
- Ngày kiểm tra tài liệu đối chiếu chính thức: 2026-08-19; liên kết được liệt kê trong bảng đối chiếu OpenAI / Anthropic / Google Gemini.
Trọng tâm của V2.0 không phải là thêm tính từ, mà là tách rõ "đã triển khai" và "chưa triển khai": việc sử dụng production, đối chiếu quản trị, bất thường trạng thái, ký GPG và vi phạm SLA đều được công khai đúng theo dữ liệu nguồn.
Toàn vẹn Phát hành và GPG
Đã cấu hình ký GPG cục bộ. signingkey=0934DFA0EDA6363A. Đang chờ xác minh trên GitHub cho đến khi tải lên khóa công khai và xác nhận huy hiệu Verified.
Đối chiếu OpenAI / Anthropic / Google Gemini
Tài liệu quản trị của trang được đối chiếu đồng thời với ba khung công khai: tài liệu mô hình, system card/model card, đánh giá an toàn, quản trị dữ liệu và chính sách sử dụng. Đây là đối chiếu quản trị, không phải tuyên bố rằng mọi nhà cung cấp đều đã dùng cho production inference. Ngày kiểm tra tài liệu chính thức: 2026-08-19
| Nhà cung cấp đối chiếu | Trọng tâm quản trị | Công khai của Starnum | Nguồn chính thức |
|---|---|---|---|
| OpenAI | Tài liệu mô hình, ghi chú mô hình mới nhất, thực hành an toàn tốt nhất và kiểm soát dữ liệu. | Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị. | https://platform.openai.com/docs/models |
| Anthropic | Tài liệu mô hình Claude, system card/model card, Responsible Scaling và chính sách an toàn. | Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị. | https://docs.anthropic.com/en/docs/about-claude/models |
| Google Gemini | Tài liệu mô hình Gemini API, cài đặt an toàn, quản trị dữ liệu và chính sách nền tảng. | Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị. | https://ai.google.dev/gemini-api/docs/models |
Lớp Bằng chứng Có thể Kiểm chứng
Khối này không phải khẩu hiệu; mỗi tuyên bố cốt lõi đều có claim id, JSON nguồn, hash và lệnh xác minh có thể chạy lại. Trang công khai chỉ tiết lộ bằng chứng quản trị có thể công khai, không tiết lộ mã nguồn, khóa bí mật, dữ liệu riêng tư hay chi tiết bề mặt tấn công có thể bị lạm dụng.
| Claim ID | Giá trị có thể kiểm chứng | Trạng thái | Trang phụ trách | Nguồn và xác minh |
|---|---|---|---|---|
| claim.public-url-manifest.indexable-count Danh mục URL công khai và canonical |
38,965 indexable URLs | verified | sitewide | node scripts/generate-public-evidence-manifest.js --dry |
| claim.trust-pages.audit-pass-rate Kiểm toán máy các trang quản trị |
180/180 pass | verified | sitewide | node scripts/verify-trust-pages.js --check |
| claim.discovery-surface.zero-errors Kiểm toán AI discovery surface |
{"errors":0,"warnings":0} | verified | sitewide | node scripts/verify-discovery-surface.js |
| claim.structured-data.jsonld-errors Kiểm toán JSON-LD / dữ liệu có cấu trúc |
{"structured_data_invalid_files":0,"breadcrumb_count":28274,"faq_count":27506,"dataset_count":30,"article_count":27406} | verified | sitewide | node scripts/site-machine-audit.js |
| claim.status.sla-state Nguồn SLA trang trạng thái |
critical / 5 critical, 0 warnings | verified | sitewide | node scripts/generate-status-page.js |
| claim.provider-alignment.openai-anthropic-gemini Đối chiếu OpenAI / Anthropic / Google Gemini |
benchmark alignment only unless code/config evidence exists | verified | sitewide | node scripts/verify-public-evidence.js --check |
| claim.transparency-report.sha256 Neo SHA-256 báo cáo minh bạch |
{"report":"transparency/report-2026-Q3.json","sha256":"47b09e2ca4e8b8fe9dffdfaccef3b11212de9ee3a8a14badca8044e2481203c5"} | verified | sitewide | node scripts/update-transparency-current-data.js |
| claim.release-integrity.gpg-signing Trạng thái ký GPG |
GPG signing configured locally; GitHub verification pending | github_verification_pending | sitewide | gpg --list-secret-keys --keyid-format=long && git log -1 --show-signature |
Thẻ Hệ thống V2.0: Lớp Minh bạch Kỹ thuật Công khai
Lớp này tập hợp các bằng chứng quản trị kỹ thuật có thể công khai: kiến trúc, nguồn dữ liệu, ranh giới sử dụng AI, cổng chất lượng, toàn vẹn phát hành và đối chiếu nhà cung cấp. Phạm vi công khai cố ý loại trừ mã nguồn, khóa bí mật, chi tiết bề mặt tấn công có thể bị lạm dụng và dữ liệu cá nhân.
Kiến trúc công khai
Cloudflare Pages/Workers, R2/D1/KV/Pagefind và các script tạo nội dung cục bộ cùng tạo thành chuỗi phát hành trang công khai và dữ liệu quản trị. Bên ngoài chỉ công khai hành vi, trạng thái và nguồn dữ liệu có thể kiểm chứng, không công khai khóa bí mật hay quyền vận hành nội bộ.
Công khai sử dụng AI
Quét mã nguồn hiện xác minh cấu hình mô hình production inference: chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production. OpenAI, Anthropic và Google Gemini được dùng làm đối chiếu khung quản trị; nhà cung cấp không có bằng chứng mã nguồn hoặc cấu hình sẽ không được ghi nhận là đã đưa vào sử dụng chính thức.
Cổng chất lượng và an toàn
Kiểm toán trang quản trị đạt 180/180, lỗi JSON-LD 0, lỗi discovery surface 0. Trang trạng thái hiển thị đúng thực tế: critical / 4 critical, 0 warnings.
Dữ liệu và khả năng truy vết
Cơ sở tri thức 32,724 chunks, TM 0 entries, AI answer-ready 7,976/7,976. Dữ liệu công khai truy vết về data/state-machine/*, data/*audit*.json và báo cáo transparency.
| Lĩnh vực quản trị | OpenAI | Anthropic | Google Gemini | Bằng chứng triển khai của Starnum |
|---|---|---|---|---|
| Công khai model/system card | OpenAI models + safety docs | Claude model docs + system/model cards | Gemini model docs + safety settings | system-card, model-card, methodology, benchmark, transparency-log |
| Đánh giá an toàn và ranh giới sử dụng | Safety best practices / deployment checklist | Responsible Scaling / safety policy | Gemini safety controls / policy | AI safety, acceptable-use, ethics, risk-boundary copy, crawler policy audit |
| Quản trị dữ liệu | Data controls / privacy controls | privacy and data handling docs | Gemini API data governance references | privacy, ai-data-governance, KB/TM source tracking, SHA-256 hashes |
| Giám sát và phát hành | production checklist / eval discipline | system-card transparency discipline | model/version documentation discipline | deploy.js, status.html, SLA report, trust-pages-machine-audit, sitemap/hreflang audits |
- Nguồn: data/state-machine/model-card.json, public-bench.json, trust-pages.json, security-headers.json.
- Nguồn: data/trust-pages-machine-audit.json, data/discovery-surface-audit.json, data/ai-answer-readiness-audit.json.
- Nguồn: data/kb-machine-audit.json, data/tm/quality-audit-report.json, data/sla-report.json.
- Ngày kiểm tra tài liệu đối chiếu chính thức: 2026-08-19; liên kết được liệt kê trong bảng đối chiếu OpenAI / Anthropic / Google Gemini.
Trọng tâm của V2.0 không phải là thêm tính từ, mà là tách rõ "đã triển khai" và "chưa triển khai": việc sử dụng production, đối chiếu quản trị, bất thường trạng thái, ký GPG và vi phạm SLA đều được công khai đúng theo dữ liệu nguồn.
Toàn vẹn Phát hành và GPG
Đã cấu hình ký GPG cục bộ. signingkey=0934DFA0EDA6363A. Đang chờ xác minh trên GitHub cho đến khi tải lên khóa công khai và xác nhận huy hiệu Verified.
Đối chiếu OpenAI / Anthropic / Google Gemini
Tài liệu quản trị của trang được đối chiếu đồng thời với ba khung công khai: tài liệu mô hình, system card/model card, đánh giá an toàn, quản trị dữ liệu và chính sách sử dụng. Đây là đối chiếu quản trị, không phải tuyên bố rằng mọi nhà cung cấp đều đã dùng cho production inference. Ngày kiểm tra tài liệu chính thức: 2026-08-19
| Nhà cung cấp đối chiếu | Trọng tâm quản trị | Công khai của Starnum | Nguồn chính thức |
|---|---|---|---|
| OpenAI | Tài liệu mô hình, ghi chú mô hình mới nhất, thực hành an toàn tốt nhất và kiểm soát dữ liệu. | Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị. | https://platform.openai.com/docs/models |
| Anthropic | Tài liệu mô hình Claude, system card/model card, Responsible Scaling và chính sách an toàn. | Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị. | https://docs.anthropic.com/en/docs/about-claude/models |
| Google Gemini | Tài liệu mô hình Gemini API, cài đặt an toàn, quản trị dữ liệu và chính sách nền tảng. | Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị. | https://ai.google.dev/gemini-api/docs/models |