Makalah Penelitian
Penelitian AI yang diterbitkan starnum.com.tw tentang Zi Wei Dou Shu: metodologi, benchmark, kerangka transparansi
Multi-Model Cross-Validation for Zi Wei Dou Shu AI Interpretation:
A Reproducible Benchmark and Transparency Framework
Kami menyajikan benchmark AI pertama yang terdokumentasi publik untuk penafsiran Zi Wei Dou Shu. Arsitektur validasi silang multi-model kami menggunakan rujukan tata kelola OpenAI / Anthropic / Google Gemini untuk memvalidasi analisis secara independen, menghasilkan peningkatan +6.2 poin di atas baseline model tunggal pada rubrik enam dimensi kami. Kami merilis starnum-bench: 37 bagan yang telah dianonimkan lengkap dengan rubrik skor, skrip evaluasi, dan hasil baseline April 2026.
Kategori: cs.AI · cs.CY (Computers and Society)
📎 Kutipan BibTeX
@techreport{starnum2026preprint,
title = {Multi-Model Cross-Validation for Zi Wei Dou Shu AI Interpretation:
A Reproducible Benchmark and Transparency Framework},
author = {{Starnum Research Team}},
year = {2026},
month = {April},
institution = {starnum.com.tw},
type = {Preprint},
url = {https://starnum.com.tw/papers/},
note = {Version 1.0. Preprint available at starnum.com.tw/papers/}
}
Jika Anda menggunakan starnum-bench atau metodologi yang dijelaskan dalam preprint kami, silakan kutip dengan entri BibTeX di atas. Untuk atribusi data, Anda juga dapat mengutip repositori benchmark publik:
https://starnum.com.tw/benchmark/en