Benchmark Kualitas Analisis Astrologi
Starnum Logic Engine v5.0 Hasil Evaluasi Publik | 37 Set Bagan Tetap | Terakhir Dijalankan:
Ikhtisar Pengujian
Benchmark adalah standar objektif untuk mengukur kualitas sistem analisis astrologi. Kami memelihara satu set tetap berisi 37 pengujian bagan (Golden Test Suite), yang dijalankan otomatis setelah setiap pembaruan sistem untuk memastikan kualitas analisis tidak menurun.
Set pengujian mencakup berbagai kombinasi bagan: konfigurasi berbeda dari 14 bintang utama, 12 cabang bumi istana, dengan dan tanpa waktu lahir, batang tahun yang berbeda โ mewakili seluruh rentang situasi yang mungkin dihadapi pengguna nyata.
Penilaian Enam Dimensi (April 2026)
Skor total tertimbang validasi silang multi-model: 85.4 / 100 (mengungguli baseline satu model sebesar 79.2, peningkatan +6.2)
| Dimensi | Bobot | Deskripsi | Skor |
|---|---|---|---|
| D1 | 30% | Akurasi (Sihua / Posisi Bintang) | 87.3 |
| D2 | 20% | Kelengkapan Aturan (Pola / Tiga Arah) | 82.1 |
| D3 | 20% | Kedalaman Interpretasi | 79.8 |
| D4 | 15% | Konsistensi Internal | 91.2 |
| D5 | 10% | Kualitas Hook | 84.6 |
| D6 | 5% | Kepatuhan Format | 96.4 |
Berkas Dataset (Unduhan Publik)
- ๐ dataset/classical_cases.json โ 37 konfigurasi bagan yang telah dianonimkan, hanya berisi bidang astrologi, tanpa informasi pribadi
- ๐ evaluation/scoring_rubric.json โ Kriteria penilaian enam dimensi D1โD6, dengan rincian rubrik dan metode validasi
- ๐ results/baseline-2026-04.json โ Hasil baseline April 2026, skor tertimbang multi-model
- โ๏ธ evaluate.js โ Skrip penilaian dan perbandingan yang dapat direproduksi (Node.js)
- ๐ README.md โ Dokumentasi lengkap dan petunjuk penggunaan
Metodologi Pengujian
Desain Set Pengujian
Golden Test Suite terdiri dari 37 bagan tetap yang mewakili berbagai tingkat kesulitan dan kombinasi bintang:
- Keragaman bintang: Mencakup seluruh 14 bintang utama โ Zi Wei, Tian Ji, Tai Yang, Wu Qu, Tian Tong, Lian Zhen, Tian Fu, Tai Yin, Tan Lang, Ju Men, Tian Xiang, Tian Liang, Qi Sha, Po Jun
- Keragaman istana: Istana Kehidupan tersebar di 12 cabang bumi, memastikan semua kombinasi istana tercakup
- Dengan/tanpa waktu lahir: Mencakup baik waktu lahir yang diketahui (penyusunan bagan presisi) maupun waktu lahir tidak diketahui (penyusunan bagan perkiraan)
- Cakupan batang tahun: Seluruh 10 batang langit memiliki kasus representatif, menguji akurasi perhitungan sihua
Kriteria Penilaian
- Akurasi: Apakah penilaian istana, arah masuk sihua, dan identifikasi pola sesuai dengan standar aliran Lu Binzhao โ dibandingkan dengan seluruh 127 aturan keras
- Kedalaman Analisis: Apakah interpretasi bahasa sederhana mencakup karakteristik bintang utama Istana Kehidupan, hubungan Istana Kehidupan/Tubuh, pola-pola utama, kepribadian, dan kecenderungan karier
- Tingkat Cakupan Istana: Proporsi dari 22 blok analisis standar yang benar-benar diselesaikan
Proses Validasi
- Set pengujian tetap dibaca dari basis data bagan Supabase; bagan yang sama digunakan untuk setiap pengujian
- Alat validasi logika astrologi secara otomatis membandingkan seluruh 127 aturan keras, menandai potensi kesalahan
- Perbandingan silang multi-model: beberapa alat independen menganalisis secara bersamaan, saling mengonfirmasi konsistensi
- Tinjauan manusia oleh editor profesional atas penilaian, memastikan hasil evaluasi yang objektif dan andal
- Jika validasi aturan apa pun gagal, seluruh batch dihentikan sementara dan diuji ulang setelah diperbaiki
Perbandingan vs. Situs Astrologi Umum
| Item Evaluasi | starnum.com.tw | Situs Astrologi Umum |
|---|---|---|
| Konsistensi aliran sihua | โ Aliran Lu Binzhao seragam di seluruh situs, ditandai secara eksplisit | โ Sering mencampur beberapa aliran tanpa penjelasan |
| Validasi logika analisis | โ 127 aturan keras dibandingkan otomatis | โ Tidak ada mekanisme validasi sistematis |
| Sumber pengetahuan publik | โ 8 sumber primer, ditandai satu per satu | โ Sumber tidak jelas atau sama sekali tidak diungkapkan |
| Pengujian regresi kualitas | โ 37 bagan tetap, diuji otomatis setelah pembaruan versi | โ Tidak ada mekanisme pengujian kualitas |
| Verifikasi integritas konten | โ SHA256 content hash + JSON-LD | โ Tidak ada verifikasi |
| Blok analisis terstandardisasi | โ 22 blok standar, struktur konsisten | โ Struktur berbeda tiap artikel, kedalaman tidak merata |
| Validasi silang multi-model | โ Beberapa alat dibandingkan silang | โ Tinjauan manusia tunggal |
Baseline perbandingan adalah konten publik dari situs astrologi berbahasa Mandarin utama di Taiwan dan Asia Tenggara. Tanggal evaluasi: April 2026.
Statistik Set Pengujian
| Kategori | Jumlah | Deskripsi |
|---|---|---|
| Total bagan | 37 | Tetap, perubahan dibandingkan dengan baseline setelah pembaruan versi |
| Dengan waktu lahir | 32 | Perhitungan istana waktu presisi dimungkinkan |
| Tanpa waktu lahir | 5 | Menguji kemampuan penanganan penyusunan bagan perkiraan |
| Batang tahun tercakup | 8 jenis | Jia, Yi, Bing, Ding, Wu, Ji, Geng, Ren, Gui semuanya terwakili |
| Bintang utama paling umum | Tai Yin | Bagan dengan Tai Yin di Istana Kehidupan memiliki proporsi tertinggi dalam set ini |
| Cakupan Life Path | 1โ9 | Semua Angka Life Path utama memiliki kasus pengujian |
Tentang Laporan Ini
Halaman ini dibuat secara otomatis oleh sistem evaluasi Starnum Logic Engine v5.0, dijalankan ulang dan diperbarui pada setiap pembaruan versi sistem. Metodologi evaluasi merujuk pada standar jaminan kualitas (QA) perangkat lunak industri, dipadukan dengan kebutuhan khusus analisis astrologi.
Kami memilih untuk mempublikasikan benchmark ini karena kami percaya transparansi adalah satu-satunya cara untuk membangun kepercayaan. Jika Anda memiliki pertanyaan tentang metodologi evaluasi, silakan hubungi @mychenan di Instagram.
Standar eksternal dan sumber primer
Sumber primer berikut menjadi acuan halaman ini. Ini adalah tolok ukur, bukan dukungan pihak ketiga terhadap situs ini.
Cuplikan Audit Mesin Saat Ini
Blok ini hanya menggunakan data audit lokal yang dapat dilacak. Tidak ada metrik atau klaim model tanpa dukungan yang ditambahkan.
- data/state-machine/i18n-parity.json: 8,036 parent URLs, 7,976 articles.
- data/kb-machine-audit.json: 3,238 source files, 0 missing coverage, 0 orphan chunks.
- data/discovery-surface-audit.json: 0 errors, 0 warnings.
- data/sla-report.json: critical / 3 critical, 1 warnings.
Lapisan Evidence Yang Dapat Diverifikasi
Blok ini bukan klaim naratif. Setiap pernyataan inti memiliki claim id, JSON sumber, hash, dan perintah verifikasi yang dapat dijalankan ulang. Halaman publik mengungkapkan bukti tata kelola tanpa mengekspos kode sumber, secret, data privat, atau detail permukaan serangan yang dapat dieksploitasi.
| Claim ID | Nilai yang dapat diverifikasi | Status | Pemilik | Sumber dan verifikasi |
|---|---|---|---|---|
| claim.public-url-manifest.indexable-count Daftar URL publik dan canonical |
39,104 indexable URLs | verified | sitewide | node scripts/generate-public-evidence-manifest.js --dry |
| claim.trust-pages.audit-pass-rate Audit mesin halaman tata kelola |
180/180 pass | verified | sitewide | node scripts/verify-trust-pages.js --check |
| claim.discovery-surface.zero-errors Audit permukaan discovery AI |
{"errors":0,"warnings":0} | verified | sitewide | node scripts/verify-discovery-surface.js |
| claim.structured-data.jsonld-errors Audit JSON-LD / data terstruktur |
{"structured_data_invalid_files":0,"breadcrumb_count":28274,"faq_count":27506,"dataset_count":30,"article_count":27406} | verified | sitewide | node scripts/site-machine-audit.js |
| claim.status.sla-state Sumber SLA halaman status |
critical / 4 critical, 0 warnings | verified | sitewide | node scripts/generate-status-page.js |
| claim.provider-alignment.openai-anthropic-gemini Keselarasan tolok ukur OpenAI / Anthropic / Google Gemini |
benchmark alignment only unless code/config evidence exists | verified | sitewide | node scripts/verify-public-evidence.js --check |
| claim.transparency-report.sha256 Jangkar SHA-256 laporan transparansi |
{"report":"transparency/report-2026-Q3.json","sha256":"f154fc87139b42098b02567fc93582c30addafc406420b3aea8bae79b6f4ac93"} | verified | sitewide | node scripts/update-transparency-current-data.js |
| claim.release-integrity.gpg-signing Status penandatanganan GPG |
GPG signing active locally; checked GitHub commit verification is valid | verified | sitewide | gpg --list-secret-keys --keyid-format=long && git log -1 --show-signature |
Kartu Sistem V2.0: Lapisan Transparansi Teknis
Lapisan ini mempublikasikan bukti tata kelola teknis yang dapat diungkapkan dengan aman: arsitektur, sumber data, batas penggunaan AI, gerbang kualitas, integritas rilis, dan keselarasan penyedia. Kode sumber, secret, detail permukaan serangan yang dapat dieksploitasi, dan data pribadi tetap di luar cakupan.
Arsitektur publik
Cloudflare Workers, R2/D1/KV, dan skrip pembuatan lokal bersama-sama membentuk rantai publikasi situs publik dan data tata kelola. Halaman publik hanya mengungkapkan perilaku, status, dan sumber yang dapat diverifikasi, bukan secret atau izin operasi internal.
Pengungkapan penggunaan AI
Pemindaian kode saat ini memverifikasi pengaturan model inferensi berikut: tidak ditemukan pengaturan model yang dapat diverifikasi dalam pemindaian kode produksi. OpenAI, Anthropic, dan Google Gemini menjadi tolok ukur tata kelola; penyedia tanpa bukti kode/konfigurasi tidak disajikan sebagai inferensi produksi aktif.
Gerbang kualitas dan keamanan
Audit halaman tata kelola 180/180 lulus, error JSON-LD 0, error discovery-surface 0. Halaman status melaporkan critical / 3 critical, 1 warnings apa adanya.
Keterlacakan data
Basis pengetahuan 32,724 chunk, TM 512,152 entri, AI siap-jawab 7,976/7,976. Metrik publik dapat dilacak ke data/state-machine/*, data/*audit*.json, dan laporan transparansi.
| Area tata kelola | OpenAI | Anthropic | Google Gemini | Bukti implementasi Starnum |
|---|---|---|---|---|
| Pengungkapan model/system-card | OpenAI models + safety docs | Claude model docs + system/model cards | Gemini model docs + safety settings | system-card, model-card, methodology, benchmark, transparency-log |
| Evaluasi keamanan dan batas penggunaan | Safety best practices / deployment checklist | Responsible Scaling / safety policy | Gemini safety controls / policy | AI safety, acceptable-use, ethics, teks batas risiko, audit kebijakan crawler |
| Tata kelola data | Data controls / privacy controls | privacy and data handling docs | Gemini API data governance references | privacy, ai-data-governance, pelacakan sumber KB/TM, hash SHA-256 |
| Pemantauan dan rilis | production checklist / eval discipline | system-card transparency discipline | model/version documentation discipline | deploy.js, status.html, laporan SLA, trust-pages-machine-audit, audit sitemap/hreflang |
- Sumber: data/state-machine/model-card.json, public-bench.json, trust-pages.json, security-headers.json.
- Sumber: data/trust-pages-machine-audit.json, data/discovery-surface-audit.json, data/ai-answer-readiness-audit.json.
- Sumber: data/kb-machine-audit.json, data/tm/quality-audit-report.json, data/sla-report.json.
- Dokumen tolok ukur resmi diperiksa: 2026-08-20; tautan tercantum dalam tabel keselarasan OpenAI / Anthropic / Google Gemini.
Tujuan V2.0 bukan menambah klaim, melainkan memisahkan kontrol yang telah diterapkan dari yang masih direncanakan. Penggunaan produksi, keselarasan tolok ukur, pengecualian status, penandatanganan GPG, dan pelanggaran SLA diungkapkan dari data sumber.
Integritas Rilis Dan GPG
Penandatanganan GPG aktif. signingkey=0934DFA0EDA6363A. Verifikasi commit GitHub telah diperiksa dan valid.
Keselarasan OpenAI / Anthropic / Google Gemini
Permukaan tata kelola dibandingkan dengan tiga kerangka kerja publik: dokumentasi model, system/model card, evaluasi keamanan, tata kelola data, dan kebijakan penggunaan. Ini adalah keselarasan tolok ukur, bukan klaim bahwa setiap penyedia aktif dalam inferensi produksi. Dokumen resmi diperiksa: 2026-08-20
| Penyedia | Fokus tata kelola | Pengungkapan Starnum | Sumber resmi |
|---|---|---|---|
| OpenAI | Dokumentasi model, catatan model terbaru, praktik terbaik keamanan, dan kontrol data. | Tidak ditemukan pengaturan model produksi yang dapat diverifikasi dalam pemindaian kode produksi; penyedia tercantum sebagai tolok ukur tata kelola. | https://platform.openai.com/docs/models |
| Anthropic | Dokumentasi model Claude, system/model card, Responsible Scaling, dan kebijakan keamanan. | Tidak ditemukan pengaturan model produksi yang dapat diverifikasi dalam pemindaian kode produksi; penyedia tercantum sebagai tolok ukur tata kelola. | https://docs.anthropic.com/en/docs/about-claude/models |
| Google Gemini | Dokumentasi model Gemini API, pengaturan keamanan, tata kelola data, dan kebijakan platform. | Tidak ditemukan pengaturan model produksi yang dapat diverifikasi dalam pemindaian kode produksi; penyedia tercantum sebagai tolok ukur tata kelola. | https://ai.google.dev/gemini-api/docs/models |
Lapisan Evidence Yang Dapat Diverifikasi
Blok ini bukan klaim naratif. Setiap pernyataan inti memiliki claim id, JSON sumber, hash, dan perintah verifikasi yang dapat dijalankan ulang. Halaman publik mengungkapkan bukti tata kelola tanpa mengekspos kode sumber, secret, data privat, atau detail permukaan serangan yang dapat dieksploitasi.
| Claim ID | Nilai yang dapat diverifikasi | Status | Pemilik | Sumber dan verifikasi |
|---|---|---|---|---|
| claim.public-url-manifest.indexable-count Daftar URL publik dan canonical |
39,104 indexable URLs | verified | sitewide | node scripts/generate-public-evidence-manifest.js --dry |
| claim.trust-pages.audit-pass-rate Audit mesin halaman tata kelola |
180/180 pass | verified | sitewide | node scripts/verify-trust-pages.js --check |
| claim.discovery-surface.zero-errors Audit permukaan discovery AI |
{"errors":0,"warnings":0} | verified | sitewide | node scripts/verify-discovery-surface.js |
| claim.structured-data.jsonld-errors Audit JSON-LD / data terstruktur |
{"structured_data_invalid_files":0,"breadcrumb_count":28274,"faq_count":27506,"dataset_count":30,"article_count":27406} | verified | sitewide | node scripts/site-machine-audit.js |
| claim.status.sla-state Sumber SLA halaman status |
critical / 4 critical, 0 warnings | verified | sitewide | node scripts/generate-status-page.js |
| claim.provider-alignment.openai-anthropic-gemini Keselarasan tolok ukur OpenAI / Anthropic / Google Gemini |
benchmark alignment only unless code/config evidence exists | verified | sitewide | node scripts/verify-public-evidence.js --check |
| claim.transparency-report.sha256 Jangkar SHA-256 laporan transparansi |
{"report":"transparency/report-2026-Q3.json","sha256":"f154fc87139b42098b02567fc93582c30addafc406420b3aea8bae79b6f4ac93"} | verified | sitewide | node scripts/update-transparency-current-data.js |
| claim.release-integrity.gpg-signing Status penandatanganan GPG |
GPG signing active locally; checked GitHub commit verification is valid | verified | sitewide | gpg --list-secret-keys --keyid-format=long && git log -1 --show-signature |
Kartu Sistem V2.0: Lapisan Transparansi Teknis
Lapisan ini mempublikasikan bukti tata kelola teknis yang dapat diungkapkan dengan aman: arsitektur, sumber data, batas penggunaan AI, gerbang kualitas, integritas rilis, dan keselarasan penyedia. Kode sumber, secret, detail permukaan serangan yang dapat dieksploitasi, dan data pribadi tetap di luar cakupan.
Arsitektur publik
Cloudflare Workers, R2/D1/KV, dan skrip pembuatan lokal bersama-sama membentuk rantai publikasi situs publik dan data tata kelola. Halaman publik hanya mengungkapkan perilaku, status, dan sumber yang dapat diverifikasi, bukan secret atau izin operasi internal.
Pengungkapan penggunaan AI
Pemindaian kode saat ini memverifikasi pengaturan model inferensi berikut: tidak ditemukan pengaturan model yang dapat diverifikasi dalam pemindaian kode produksi. OpenAI, Anthropic, dan Google Gemini menjadi tolok ukur tata kelola; penyedia tanpa bukti kode/konfigurasi tidak disajikan sebagai inferensi produksi aktif.
Gerbang kualitas dan keamanan
Audit halaman tata kelola 180/180 lulus, error JSON-LD 0, error discovery-surface 0. Halaman status melaporkan critical / 4 critical, 0 warnings apa adanya.
Keterlacakan data
Basis pengetahuan 32,724 chunk, TM 512,152 entri, AI siap-jawab 7,976/7,976. Metrik publik dapat dilacak ke data/state-machine/*, data/*audit*.json, dan laporan transparansi.
| Area tata kelola | OpenAI | Anthropic | Google Gemini | Bukti implementasi Starnum |
|---|---|---|---|---|
| Pengungkapan model/system-card | OpenAI models + safety docs | Claude model docs + system/model cards | Gemini model docs + safety settings | system-card, model-card, methodology, benchmark, transparency-log |
| Evaluasi keamanan dan batas penggunaan | Safety best practices / deployment checklist | Responsible Scaling / safety policy | Gemini safety controls / policy | AI safety, acceptable-use, ethics, teks batas risiko, audit kebijakan crawler |
| Tata kelola data | Data controls / privacy controls | privacy and data handling docs | Gemini API data governance references | privacy, ai-data-governance, pelacakan sumber KB/TM, hash SHA-256 |
| Pemantauan dan rilis | production checklist / eval discipline | system-card transparency discipline | model/version documentation discipline | deploy.js, status.html, laporan SLA, trust-pages-machine-audit, audit sitemap/hreflang |
- Sumber: data/state-machine/model-card.json, public-bench.json, trust-pages.json, security-headers.json.
- Sumber: data/trust-pages-machine-audit.json, data/discovery-surface-audit.json, data/ai-answer-readiness-audit.json.
- Sumber: data/kb-machine-audit.json, data/tm/quality-audit-report.json, data/sla-report.json.
- Dokumen tolok ukur resmi diperiksa: 2026-08-19; tautan tercantum dalam tabel keselarasan OpenAI / Anthropic / Google Gemini.
Tujuan V2.0 bukan menambah klaim, melainkan memisahkan kontrol yang telah diterapkan dari yang masih direncanakan. Penggunaan produksi, keselarasan tolok ukur, pengecualian status, penandatanganan GPG, dan pelanggaran SLA diungkapkan dari data sumber.
Integritas Rilis Dan GPG
Penandatanganan GPG aktif. signingkey=0934DFA0EDA6363A. Verifikasi commit GitHub telah diperiksa dan valid.
Keselarasan OpenAI / Anthropic / Google Gemini
Permukaan tata kelola dibandingkan dengan tiga kerangka kerja publik: dokumentasi model, system/model card, evaluasi keamanan, tata kelola data, dan kebijakan penggunaan. Ini adalah keselarasan tolok ukur, bukan klaim bahwa setiap penyedia aktif dalam inferensi produksi. Dokumen resmi diperiksa: 2026-08-19
| Penyedia | Fokus tata kelola | Pengungkapan Starnum | Sumber resmi |
|---|---|---|---|
| OpenAI | Dokumentasi model, catatan model terbaru, praktik terbaik keamanan, dan kontrol data. | Tidak ditemukan pengaturan model produksi yang dapat diverifikasi dalam pemindaian kode produksi; penyedia tercantum sebagai tolok ukur tata kelola. | https://platform.openai.com/docs/models |
| Anthropic | Dokumentasi model Claude, system/model card, Responsible Scaling, dan kebijakan keamanan. | Tidak ditemukan pengaturan model produksi yang dapat diverifikasi dalam pemindaian kode produksi; penyedia tercantum sebagai tolok ukur tata kelola. | https://docs.anthropic.com/en/docs/about-claude/models |
| Google Gemini | Dokumentasi model Gemini API, pengaturan keamanan, tata kelola data, dan kebijakan platform. | Tidak ditemukan pengaturan model produksi yang dapat diverifikasi dalam pemindaian kode produksi; penyedia tercantum sebagai tolok ukur tata kelola. | https://ai.google.dev/gemini-api/docs/models |
Lapisan Evidence Yang Dapat Diverifikasi
Blok ini bukan klaim naratif. Setiap pernyataan inti memiliki claim id, JSON sumber, hash, dan perintah verifikasi yang dapat dijalankan ulang. Halaman publik mengungkapkan bukti tata kelola tanpa mengekspos kode sumber, secret, data privat, atau detail permukaan serangan yang dapat dieksploitasi.
| Claim ID | Nilai yang dapat diverifikasi | Status | Pemilik | Sumber dan verifikasi |
|---|---|---|---|---|
| claim.public-url-manifest.indexable-count Daftar URL publik dan canonical |
38,965 indexable URLs | verified | sitewide | node scripts/generate-public-evidence-manifest.js --dry |
| claim.trust-pages.audit-pass-rate Audit mesin halaman tata kelola |
180/180 pass | verified | sitewide | node scripts/verify-trust-pages.js --check |
| claim.discovery-surface.zero-errors Audit permukaan discovery AI |
{"errors":0,"warnings":0} | verified | sitewide | node scripts/verify-discovery-surface.js |
| claim.structured-data.jsonld-errors Audit JSON-LD / data terstruktur |
{"structured_data_invalid_files":0,"breadcrumb_count":28274,"faq_count":27506,"dataset_count":30,"article_count":27406} | verified | sitewide | node scripts/site-machine-audit.js |
| claim.status.sla-state Sumber SLA halaman status |
critical / 5 critical, 0 warnings | verified | sitewide | node scripts/generate-status-page.js |
| claim.provider-alignment.openai-anthropic-gemini Keselarasan tolok ukur OpenAI / Anthropic / Google Gemini |
benchmark alignment only unless code/config evidence exists | verified | sitewide | node scripts/verify-public-evidence.js --check |
| claim.transparency-report.sha256 Jangkar SHA-256 laporan transparansi |
{"report":"transparency/report-2026-Q3.json","sha256":"47b09e2ca4e8b8fe9dffdfaccef3b11212de9ee3a8a14badca8044e2481203c5"} | verified | sitewide | node scripts/update-transparency-current-data.js |
| claim.release-integrity.gpg-signing Status penandatanganan GPG |
GPG signing configured locally; GitHub verification pending | github_verification_pending | sitewide | gpg --list-secret-keys --keyid-format=long && git log -1 --show-signature |
Kartu Sistem V2.0: Lapisan Transparansi Teknis
Lapisan ini mempublikasikan bukti tata kelola teknis yang dapat diungkapkan dengan aman: arsitektur, sumber data, batas penggunaan AI, gerbang kualitas, integritas rilis, dan keselarasan penyedia. Kode sumber, secret, detail permukaan serangan yang dapat dieksploitasi, dan data pribadi tetap di luar cakupan.
Arsitektur publik
Cloudflare Workers, R2/D1/KV, dan skrip pembuatan lokal bersama-sama membentuk rantai publikasi situs publik dan data tata kelola. Halaman publik hanya mengungkapkan perilaku, status, dan sumber yang dapat diverifikasi, bukan secret atau izin operasi internal.
Pengungkapan penggunaan AI
Pemindaian kode saat ini memverifikasi pengaturan model inferensi berikut: tidak ditemukan pengaturan model yang dapat diverifikasi dalam pemindaian kode produksi. OpenAI, Anthropic, dan Google Gemini menjadi tolok ukur tata kelola; penyedia tanpa bukti kode/konfigurasi tidak disajikan sebagai inferensi produksi aktif.
Gerbang kualitas dan keamanan
Audit halaman tata kelola 180/180 lulus, error JSON-LD 0, error discovery-surface 0. Halaman status melaporkan critical / 4 critical, 0 warnings apa adanya.
Keterlacakan data
Basis pengetahuan 32,724 chunk, TM 512,152 entri, AI siap-jawab 7,976/7,976. Metrik publik dapat dilacak ke data/state-machine/*, data/*audit*.json, dan laporan transparansi.
| Area tata kelola | OpenAI | Anthropic | Google Gemini | Bukti implementasi Starnum |
|---|---|---|---|---|
| Pengungkapan model/system-card | OpenAI models + safety docs | Claude model docs + system/model cards | Gemini model docs + safety settings | system-card, model-card, methodology, benchmark, transparency-log |
| Evaluasi keamanan dan batas penggunaan | Safety best practices / deployment checklist | Responsible Scaling / safety policy | Gemini safety controls / policy | AI safety, acceptable-use, ethics, teks batas risiko, audit kebijakan crawler |
| Tata kelola data | Data controls / privacy controls | privacy and data handling docs | Gemini API data governance references | privacy, ai-data-governance, pelacakan sumber KB/TM, hash SHA-256 |
| Pemantauan dan rilis | production checklist / eval discipline | system-card transparency discipline | model/version documentation discipline | deploy.js, status.html, laporan SLA, trust-pages-machine-audit, audit sitemap/hreflang |
- Sumber: data/state-machine/model-card.json, public-bench.json, trust-pages.json, security-headers.json.
- Sumber: data/trust-pages-machine-audit.json, data/discovery-surface-audit.json, data/ai-answer-readiness-audit.json.
- Sumber: data/kb-machine-audit.json, data/tm/quality-audit-report.json, data/sla-report.json.
- Dokumen tolok ukur resmi diperiksa: 2026-08-19; tautan tercantum dalam tabel keselarasan OpenAI / Anthropic / Google Gemini.
Tujuan V2.0 bukan menambah klaim, melainkan memisahkan kontrol yang telah diterapkan dari yang masih direncanakan. Penggunaan produksi, keselarasan tolok ukur, pengecualian status, penandatanganan GPG, dan pelanggaran SLA diungkapkan dari data sumber.
Integritas Rilis Dan GPG
Penandatanganan GPG dikonfigurasi secara lokal. signingkey=0934DFA0EDA6363A. Verifikasi GitHub tertunda hingga unggah kunci publik dan lencana Verified dikonfirmasi.
Keselarasan OpenAI / Anthropic / Google Gemini
Permukaan tata kelola dibandingkan dengan tiga kerangka kerja publik: dokumentasi model, system/model card, evaluasi keamanan, tata kelola data, dan kebijakan penggunaan. Ini adalah keselarasan tolok ukur, bukan klaim bahwa setiap penyedia aktif dalam inferensi produksi. Dokumen resmi diperiksa: 2026-08-19
| Penyedia | Fokus tata kelola | Pengungkapan Starnum | Sumber resmi |
|---|---|---|---|
| OpenAI | Dokumentasi model, catatan model terbaru, praktik terbaik keamanan, dan kontrol data. | Tidak ditemukan pengaturan model produksi yang dapat diverifikasi dalam pemindaian kode produksi; penyedia tercantum sebagai tolok ukur tata kelola. | https://platform.openai.com/docs/models |
| Anthropic | Dokumentasi model Claude, system/model card, Responsible Scaling, dan kebijakan keamanan. | Tidak ditemukan pengaturan model produksi yang dapat diverifikasi dalam pemindaian kode produksi; penyedia tercantum sebagai tolok ukur tata kelola. | https://docs.anthropic.com/en/docs/about-claude/models |
| Google Gemini | Dokumentasi model Gemini API, pengaturan keamanan, tata kelola data, dan kebijakan platform. | Tidak ditemukan pengaturan model produksi yang dapat diverifikasi dalam pemindaian kode produksi; penyedia tercantum sebagai tolok ukur tata kelola. | https://ai.google.dev/gemini-api/docs/models |