Benchmark Chất lượng Phân tích Mệnh lý

Kết quả đánh giá công khai Starnum Logic Engine v5.0 | Bộ 37 lá số cố định | Lần chạy gần nhất:

Tổng quan kiểm thử

Benchmark là tiêu chuẩn khách quan để đo lường chất lượng của hệ thống phân tích mệnh lý. Chúng tôi duy trì một bộ 37 lá số kiểm thử cố định (Golden Test Suite), tự động chạy sau mỗi lần cập nhật hệ thống để xác nhận chất lượng phân tích không bị suy giảm.

Bộ kiểm thử bao phủ nhiều tổ hợp lá số khác nhau: các cấu hình khác nhau của 14 chính tinh, 12 địa chi cung vị, có và không có giờ sinh, các thiên can năm khác nhau — đại diện cho toàn bộ tình huống người dùng thực tế có thể gặp phải.

92
/ 100
ĐỘ CHÍNH XÁC
88
/ 100
ĐỘ SÂU PHÂN TÍCH
94
/ 100
TỶ LỆ BAO PHỦ CUNG VỊ

Phiên bản bộ kiểm thử: v1.0 | Quy mô bộ kiểm thử: 37 lá số | Ngày chạy: 2026-04-10

Đánh giá sáu chiều (tháng 4/2026)

Tổng điểm có trọng số qua xác thực chéo đa mô hình: 85.4 / 100 (vượt mức nền một mô hình 79.2, cải thiện +6.2)

ChiềuTrọng sốMô tảĐiểm
D130%Độ chính xác (Tứ Hóa / vị trí sao)87.3
D220%Độ đầy đủ quy tắc (cách cục / tam phương)82.1
D320%Độ sâu diễn giải79.8
D415%Tính nhất quán nội bộ91.2
D510%Chất lượng hook84.6
D65%Tuân thủ định dạng96.4

Tệp bộ dữ liệu (tải công khai)

Giấy phép: CC BY 4.0 · Trích dẫn: Starnum Research Team (2026). starnum-bench v1.0.

Phương pháp luận kiểm thử

Thiết kế bộ kiểm thử

Golden Test Suite (bộ kiểm thử vàng) gồm 37 lá số cố định, đại diện cho các mức độ khó và tổ hợp sao khác nhau:

Tiêu chuẩn chấm điểm

Quy trình xác minh

  1. Bộ kiểm thử cố định được đọc từ cơ sở dữ liệu lá số Supabase; mỗi lần kiểm thử dùng cùng một bộ lá số
  2. Công cụ xác minh logic mệnh lý tự động đối chiếu 127 quy tắc cứng, đánh dấu lỗi tiềm ẩn
  3. Đối chiếu chéo đa mô hình: nhiều công cụ độc lập phân tích đồng thời, xác nhận chéo tính nhất quán của kết luận
  4. Biên tập viên chuyên môn rà soát thủ công điểm số, đảm bảo kết quả đánh giá khách quan và đáng tin cậy
  5. Nếu bất kỳ quy tắc nào không vượt qua xác minh, toàn bộ lô kết quả sẽ bị tạm hoãn, kiểm thử lại sau khi sửa

So sánh với các trang mệnh lý thông thường

Hạng mục đánh giá starnum.com.tw Trang mệnh lý thông thường
Tính nhất quán trường phái Tứ Hóa Thống nhất phái Lục Bân Triệu toàn trang, ghi chú rõ ràng Thường trộn lẫn nhiều trường phái, không giải thích khác biệt
Xác minh logic phân tích Tự động đối chiếu 127 quy tắc cứng Không có cơ chế xác minh hệ thống
Nguồn tri thức công khai 8 nguồn chính, ghi chú từng nguồn Nguồn không rõ hoặc hoàn toàn không công bố
Kiểm thử hồi quy chất lượng 37 lá số cố định, tự động kiểm thử sau mỗi lần cập nhật phiên bản Không có cơ chế kiểm thử chất lượng
Xác minh toàn vẹn nội dung SHA256 content hash + JSON-LD Không xác minh
Chuẩn hóa khối phân tích 22 khối chuẩn, cấu trúc nhất quán Cấu trúc khác nhau giữa các bài, độ sâu không đồng đều
Xác thực chéo đa mô hình Nhiều bộ công cụ đối chiếu chéo Chỉ rà soát thủ công đơn lẻ

Cơ sở so sánh là nội dung công khai của các trang mệnh lý tiếng Trung lớn tại Đài Loan và Đông Nam Á. Thời điểm đánh giá: tháng 4/2026.

Thống kê bộ kiểm thử

Danh mụcSố lượngMô tả
Tổng số lá số37Cố định không đổi, đối chiếu chênh lệch với mức nền sau mỗi lần cập nhật phiên bản
Có giờ sinh32Có thể tính chính xác cung Thời
Không có giờ sinh5Kiểm tra khả năng xử lý lập lá số ước lượng
Bao phủ thiên can năm8 loạiGiáp, Ất, Bính, Đinh, Mậu, Kỷ, Canh, Nhâm, Quý đều có đại diện
Chính tinh phổ biến nhấtThái ÂmLá số có Thái Âm tại Mệnh cung chiếm tỷ lệ cao nhất trong bộ
Bao phủ Thần Số HọcSố 1–9Mỗi số chủ đạo chính đều có case kiểm thử

Nguồn dữ liệu: data/eval-set.json | Phiên bản: 1.0 | Thời gian tạo: 2026-04-10

Về báo cáo này

Trang này được hệ thống đánh giá của Starnum Logic Engine v5.0 tự động tạo ra, chạy lại và cập nhật dữ liệu sau mỗi lần cập nhật phiên bản hệ thống. Phương pháp đánh giá tham khảo tiêu chuẩn đảm bảo chất lượng phần mềm (QA) trong ngành, kết hợp với yêu cầu đặc thù của phân tích mệnh lý.

Chúng tôi chọn công khai benchmark này vì tin rằng minh bạch là cách duy nhất để xây dựng lòng tin. Nếu bạn có bất kỳ thắc mắc nào về phương pháp đánh giá, hãy liên hệ qua @mychenan trên Instagram.

Tiêu chuẩn bên ngoài và nguồn sơ cấp

Các nguồn sơ cấp này định hướng nội dung trang. Đây là chuẩn đối chiếu, không phải sự chứng thực của bên thứ ba.

Ảnh chụp Kiểm toán Máy Hiện tại

Khối này chỉ dùng dữ liệu kiểm toán có thể truy vết tại chỗ, không thêm số liệu hay tuyên bố không có nguồn. Ngày hiển thị là ngày tạo thực tế.

2026-08-19
Ngày cập nhật
17/17
Vòng lặp LLM
180/180
Trang quản trị
0
Lỗi JSON-LD
32,724
KB chunks (HEALTHY)
512,152
TM entries; verified 6,250
7,976/7,976
AI answer-ready; failures 0
critical
Trang trạng thái: 4 critical, 0 warnings

Lớp Bằng chứng Có thể Kiểm chứng

Khối này không phải khẩu hiệu; mỗi tuyên bố cốt lõi đều có claim id, JSON nguồn, hash và lệnh xác minh có thể chạy lại. Trang công khai chỉ tiết lộ bằng chứng quản trị có thể công khai, không tiết lộ mã nguồn, khóa bí mật, dữ liệu riêng tư hay chi tiết bề mặt tấn công có thể bị lạm dụng.

Claim IDGiá trị có thể kiểm chứngTrạng tháiTrang phụ tráchNguồn và xác minh
claim.public-url-manifest.indexable-count
Danh mục URL công khai và canonical
38,965 indexable URLs verified sitewide node scripts/generate-public-evidence-manifest.js --dry
claim.trust-pages.audit-pass-rate
Kiểm toán máy các trang quản trị
180/180 pass verified sitewide node scripts/verify-trust-pages.js --check
claim.discovery-surface.zero-errors
Kiểm toán AI discovery surface
{"errors":0,"warnings":0} verified sitewide node scripts/verify-discovery-surface.js
claim.structured-data.jsonld-errors
Kiểm toán JSON-LD / dữ liệu có cấu trúc
{"structured_data_invalid_files":0,"breadcrumb_count":28274,"faq_count":27506,"dataset_count":30,"article_count":27406} verified sitewide node scripts/site-machine-audit.js
claim.status.sla-state
Nguồn SLA trang trạng thái
critical / 5 critical, 0 warnings verified sitewide node scripts/generate-status-page.js
claim.provider-alignment.openai-anthropic-gemini
Đối chiếu OpenAI / Anthropic / Google Gemini
benchmark alignment only unless code/config evidence exists verified sitewide node scripts/verify-public-evidence.js --check
claim.transparency-report.sha256
Neo SHA-256 báo cáo minh bạch
{"report":"transparency/report-2026-Q3.json","sha256":"47b09e2ca4e8b8fe9dffdfaccef3b11212de9ee3a8a14badca8044e2481203c5"} verified sitewide node scripts/update-transparency-current-data.js
claim.release-integrity.gpg-signing
Trạng thái ký GPG
GPG signing configured locally; GitHub verification pending github_verification_pending sitewide gpg --list-secret-keys --keyid-format=long && git log -1 --show-signature

Thẻ Hệ thống V2.0: Lớp Minh bạch Kỹ thuật Công khai

Lớp này tập hợp các bằng chứng quản trị kỹ thuật có thể công khai: kiến trúc, nguồn dữ liệu, ranh giới sử dụng AI, cổng chất lượng, toàn vẹn phát hành và đối chiếu nhà cung cấp. Phạm vi công khai cố ý loại trừ mã nguồn, khóa bí mật, chi tiết bề mặt tấn công có thể bị lạm dụng và dữ liệu cá nhân.

Kiến trúc công khai

Cloudflare Pages/Workers, R2/D1/KV/Pagefind và các script tạo nội dung cục bộ cùng tạo thành chuỗi phát hành trang công khai và dữ liệu quản trị. Bên ngoài chỉ công khai hành vi, trạng thái và nguồn dữ liệu có thể kiểm chứng, không công khai khóa bí mật hay quyền vận hành nội bộ.

Công khai sử dụng AI

Quét mã nguồn hiện xác minh cấu hình mô hình production inference: chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production. OpenAI, Anthropic và Google Gemini được dùng làm đối chiếu khung quản trị; nhà cung cấp không có bằng chứng mã nguồn hoặc cấu hình sẽ không được ghi nhận là đã đưa vào sử dụng chính thức.

Cổng chất lượng và an toàn

Kiểm toán trang quản trị đạt 180/180, lỗi JSON-LD 0, lỗi discovery surface 0. Trang trạng thái hiển thị đúng thực tế: critical / 4 critical, 0 warnings.

Dữ liệu và khả năng truy vết

Cơ sở tri thức 32,724 chunks, TM 512,152 entries, AI answer-ready 7,976/7,976. Dữ liệu công khai truy vết về data/state-machine/*, data/*audit*.json và báo cáo transparency.

Lĩnh vực quản trịOpenAIAnthropicGoogle GeminiBằng chứng triển khai của Starnum
Công khai model/system cardOpenAI models + safety docsClaude model docs + system/model cardsGemini model docs + safety settingssystem-card, model-card, methodology, benchmark, transparency-log
Đánh giá an toàn và ranh giới sử dụngSafety best practices / deployment checklistResponsible Scaling / safety policyGemini safety controls / policyAI safety, acceptable-use, ethics, risk-boundary copy, crawler policy audit
Quản trị dữ liệuData controls / privacy controlsprivacy and data handling docsGemini API data governance referencesprivacy, ai-data-governance, KB/TM source tracking, SHA-256 hashes
Giám sát và phát hànhproduction checklist / eval disciplinesystem-card transparency disciplinemodel/version documentation disciplinedeploy.js, status.html, SLA report, trust-pages-machine-audit, sitemap/hreflang audits

Trọng tâm của V2.0 không phải là thêm tính từ, mà là tách rõ "đã triển khai" và "chưa triển khai": việc sử dụng production, đối chiếu quản trị, bất thường trạng thái, ký GPG và vi phạm SLA đều được công khai đúng theo dữ liệu nguồn.

Toàn vẹn Phát hành và GPG

Đã cấu hình ký GPG cục bộ. signingkey=0934DFA0EDA6363A. Đang chờ xác minh trên GitHub cho đến khi tải lên khóa công khai và xác nhận huy hiệu Verified.

Đối chiếu OpenAI / Anthropic / Google Gemini

Tài liệu quản trị của trang được đối chiếu đồng thời với ba khung công khai: tài liệu mô hình, system card/model card, đánh giá an toàn, quản trị dữ liệu và chính sách sử dụng. Đây là đối chiếu quản trị, không phải tuyên bố rằng mọi nhà cung cấp đều đã dùng cho production inference. Ngày kiểm tra tài liệu chính thức: 2026-08-19

Nhà cung cấp đối chiếuTrọng tâm quản trịCông khai của StarnumNguồn chính thức
OpenAITài liệu mô hình, ghi chú mô hình mới nhất, thực hành an toàn tốt nhất và kiểm soát dữ liệu.Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị.https://platform.openai.com/docs/models
AnthropicTài liệu mô hình Claude, system card/model card, Responsible Scaling và chính sách an toàn.Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị.https://docs.anthropic.com/en/docs/about-claude/models
Google GeminiTài liệu mô hình Gemini API, cài đặt an toàn, quản trị dữ liệu và chính sách nền tảng.Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị.https://ai.google.dev/gemini-api/docs/models

Lớp Bằng chứng Có thể Kiểm chứng

Khối này không phải khẩu hiệu; mỗi tuyên bố cốt lõi đều có claim id, JSON nguồn, hash và lệnh xác minh có thể chạy lại. Trang công khai chỉ tiết lộ bằng chứng quản trị có thể công khai, không tiết lộ mã nguồn, khóa bí mật, dữ liệu riêng tư hay chi tiết bề mặt tấn công có thể bị lạm dụng.

Claim IDGiá trị có thể kiểm chứngTrạng tháiTrang phụ tráchNguồn và xác minh
claim.public-url-manifest.indexable-count
Danh mục URL công khai và canonical
38,965 indexable URLs verified sitewide node scripts/generate-public-evidence-manifest.js --dry
claim.trust-pages.audit-pass-rate
Kiểm toán máy các trang quản trị
180/180 pass verified sitewide node scripts/verify-trust-pages.js --check
claim.discovery-surface.zero-errors
Kiểm toán AI discovery surface
{"errors":0,"warnings":0} verified sitewide node scripts/verify-discovery-surface.js
claim.structured-data.jsonld-errors
Kiểm toán JSON-LD / dữ liệu có cấu trúc
{"structured_data_invalid_files":0,"breadcrumb_count":28274,"faq_count":27506,"dataset_count":30,"article_count":27406} verified sitewide node scripts/site-machine-audit.js
claim.status.sla-state
Nguồn SLA trang trạng thái
critical / 5 critical, 0 warnings verified sitewide node scripts/generate-status-page.js
claim.provider-alignment.openai-anthropic-gemini
Đối chiếu OpenAI / Anthropic / Google Gemini
benchmark alignment only unless code/config evidence exists verified sitewide node scripts/verify-public-evidence.js --check
claim.transparency-report.sha256
Neo SHA-256 báo cáo minh bạch
{"report":"transparency/report-2026-Q3.json","sha256":"47b09e2ca4e8b8fe9dffdfaccef3b11212de9ee3a8a14badca8044e2481203c5"} verified sitewide node scripts/update-transparency-current-data.js
claim.release-integrity.gpg-signing
Trạng thái ký GPG
GPG signing configured locally; GitHub verification pending github_verification_pending sitewide gpg --list-secret-keys --keyid-format=long && git log -1 --show-signature

Thẻ Hệ thống V2.0: Lớp Minh bạch Kỹ thuật Công khai

Lớp này tập hợp các bằng chứng quản trị kỹ thuật có thể công khai: kiến trúc, nguồn dữ liệu, ranh giới sử dụng AI, cổng chất lượng, toàn vẹn phát hành và đối chiếu nhà cung cấp. Phạm vi công khai cố ý loại trừ mã nguồn, khóa bí mật, chi tiết bề mặt tấn công có thể bị lạm dụng và dữ liệu cá nhân.

Kiến trúc công khai

Cloudflare Pages/Workers, R2/D1/KV/Pagefind và các script tạo nội dung cục bộ cùng tạo thành chuỗi phát hành trang công khai và dữ liệu quản trị. Bên ngoài chỉ công khai hành vi, trạng thái và nguồn dữ liệu có thể kiểm chứng, không công khai khóa bí mật hay quyền vận hành nội bộ.

Công khai sử dụng AI

Quét mã nguồn hiện xác minh cấu hình mô hình production inference: chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production. OpenAI, Anthropic và Google Gemini được dùng làm đối chiếu khung quản trị; nhà cung cấp không có bằng chứng mã nguồn hoặc cấu hình sẽ không được ghi nhận là đã đưa vào sử dụng chính thức.

Cổng chất lượng và an toàn

Kiểm toán trang quản trị đạt 180/180, lỗi JSON-LD 0, lỗi discovery surface 0. Trang trạng thái hiển thị đúng thực tế: critical / 4 critical, 0 warnings.

Dữ liệu và khả năng truy vết

Cơ sở tri thức 32,724 chunks, TM 0 entries, AI answer-ready 7,976/7,976. Dữ liệu công khai truy vết về data/state-machine/*, data/*audit*.json và báo cáo transparency.

Lĩnh vực quản trịOpenAIAnthropicGoogle GeminiBằng chứng triển khai của Starnum
Công khai model/system cardOpenAI models + safety docsClaude model docs + system/model cardsGemini model docs + safety settingssystem-card, model-card, methodology, benchmark, transparency-log
Đánh giá an toàn và ranh giới sử dụngSafety best practices / deployment checklistResponsible Scaling / safety policyGemini safety controls / policyAI safety, acceptable-use, ethics, risk-boundary copy, crawler policy audit
Quản trị dữ liệuData controls / privacy controlsprivacy and data handling docsGemini API data governance referencesprivacy, ai-data-governance, KB/TM source tracking, SHA-256 hashes
Giám sát và phát hànhproduction checklist / eval disciplinesystem-card transparency disciplinemodel/version documentation disciplinedeploy.js, status.html, SLA report, trust-pages-machine-audit, sitemap/hreflang audits

Trọng tâm của V2.0 không phải là thêm tính từ, mà là tách rõ "đã triển khai" và "chưa triển khai": việc sử dụng production, đối chiếu quản trị, bất thường trạng thái, ký GPG và vi phạm SLA đều được công khai đúng theo dữ liệu nguồn.

Toàn vẹn Phát hành và GPG

Đã cấu hình ký GPG cục bộ. signingkey=0934DFA0EDA6363A. Đang chờ xác minh trên GitHub cho đến khi tải lên khóa công khai và xác nhận huy hiệu Verified.

Đối chiếu OpenAI / Anthropic / Google Gemini

Tài liệu quản trị của trang được đối chiếu đồng thời với ba khung công khai: tài liệu mô hình, system card/model card, đánh giá an toàn, quản trị dữ liệu và chính sách sử dụng. Đây là đối chiếu quản trị, không phải tuyên bố rằng mọi nhà cung cấp đều đã dùng cho production inference. Ngày kiểm tra tài liệu chính thức: 2026-08-19

Nhà cung cấp đối chiếuTrọng tâm quản trịCông khai của StarnumNguồn chính thức
OpenAITài liệu mô hình, ghi chú mô hình mới nhất, thực hành an toàn tốt nhất và kiểm soát dữ liệu.Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị.https://platform.openai.com/docs/models
AnthropicTài liệu mô hình Claude, system card/model card, Responsible Scaling và chính sách an toàn.Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị.https://docs.anthropic.com/en/docs/about-claude/models
Google GeminiTài liệu mô hình Gemini API, cài đặt an toàn, quản trị dữ liệu và chính sách nền tảng.Hiện chưa tìm thấy cấu hình mô hình có thể kiểm chứng trong quét mã production; nhà cung cấp mô hình chỉ được liệt kê để đối chiếu quản trị.https://ai.google.dev/gemini-api/docs/models