← starnum.com.tw

Makalah Penelitian

Penelitian AI yang diterbitkan starnum.com.tw tentang Zi Wei Dou Shu: metodologi, benchmark, kerangka transparansi

Preprint · v1.0 · April 2026

Multi-Model Cross-Validation for Zi Wei Dou Shu AI Interpretation:
A Reproducible Benchmark and Transparency Framework

Starnum Research Team  ·  starnum.com.tw  ·  2026-04-12  ·  Lisensi: CC BY 4.0

Kami menyajikan benchmark AI pertama yang terdokumentasi publik untuk penafsiran Zi Wei Dou Shu. Arsitektur validasi silang multi-model kami menggunakan rujukan tata kelola OpenAI / Anthropic / Google Gemini untuk memvalidasi analisis secara independen, menghasilkan peningkatan +6.2 poin di atas baseline model tunggal pada rubrik enam dimensi kami. Kami merilis starnum-bench: 37 bagan yang telah dianonimkan lengkap dengan rubrik skor, skrip evaluasi, dan hasil baseline April 2026.

Kategori: cs.AI · cs.CY (Computers and Society)

📎 Kutipan BibTeX
@techreport{starnum2026preprint,
  title     = {Multi-Model Cross-Validation for Zi Wei Dou Shu AI Interpretation:
               A Reproducible Benchmark and Transparency Framework},
  author    = {{Starnum Research Team}},
  year      = {2026},
  month     = {April},
  institution = {starnum.com.tw},
  type      = {Preprint},
  url       = {https://starnum.com.tw/papers/},
  note      = {Version 1.0. Preprint available at starnum.com.tw/papers/}
}
Skor Benchmark — Baseline April 2026
D1 Faktual
87.3
D2 Kelengkapan
82.1
D3 Kedalaman
79.8
D4 Konsistensi
91.2
D5 Hook
84.6
D6 Format
96.4
Keseluruhan
85.4
Rubrik Enam Dimensi
D1
Akurasi Faktual
bobot 30%
D2
Kelengkapan Aturan
bobot 20%
D3
Kedalaman Interpretasi
bobot 20%
D4
Konsistensi Internal
bobot 15%
D5
Kualitas Hook
bobot 10%
D6
Kepatuhan Format
bobot 5%
Cara Mengutip

Jika Anda menggunakan starnum-bench atau metodologi yang dijelaskan dalam preprint kami, silakan kutip dengan entri BibTeX di atas. Untuk atribusi data, Anda juga dapat mengutip repositori benchmark publik: https://starnum.com.tw/benchmark/en