命理分析品質ベンチマーク

Starnum Logic Engine v5.0 公開評価結果 | 37 件の固定命盤セット | 最終実行:

テスト概要

ベンチマークは、命理分析システムの品質を測定するための客観的な基準です。37件の固定命盤テストセット(ゴールデンテストスイート)を維持管理し、システム更新のたびに自動実行して分析品質が低下していないことを確認します。

テストセットは多様な命盤の組み合わせを網羅しています:14主星の異なる配置、12宮支、出生時刻あり・なし、異なる年干など — 実際のユーザーが遭遇しうるあらゆる状況を代表しています。

92
/ 100
正確性
88
/ 100
分析深度
94
/ 100
宮位カバー率

テストスイートバージョン:v1.0 | テストセット規模:37命盤 | 実行日:2026-04-10

六次元評価基準(2026年4月)

多モデル交差検証加重合計スコア:85.4 / 100(シングルモデルベースライン79.2を上回り、+6.2向上)

次元重み説明スコア
D130%正確性(四化 / 星位)87.3
D220%ルール完全性(格局 / 三方)82.1
D320%解釈の深さ79.8
D415%内部一貫性91.2
D510%フック品質84.6
D65%フォーマット準拠96.4

データセットファイル(公開ダウンロード)

ライセンス:CC BY 4.0 · 引用:Starnum Research Team (2026). starnum-bench v1.0.

テスト方法論

テストセット設計

ゴールデンテストスイートは、異なる難易度レベルと星の組み合わせを代表する37件の固定命盤で構成されています:

評価基準

検証プロセス

  1. 固定テストセットをSupabase命盤データベースから読み込み、毎回同じ命盤を使用
  2. 命理ロジック検証ツールが127条のハードルールを自動照合し、潜在的エラーにフラグを立てる
  3. 多モデル交差比較:複数の独立したツールが同時に分析し、一貫性を相互確認
  4. 専門編集者による採点の人的審査、客観的で信頼性の高い評価結果を確保
  5. いずれかのルール検証が失敗した場合、バッチ全体を一時停止し修正後に再テスト

一般命理ウェブサイトとの比較

評価項目 starnum.com.tw 一般命理サイト
四化派系の一貫性 全サイトで陸斌兆派に統一、明示的に注記 多派混用・説明なしが多い
分析ロジック検証 127条ハードルールを自動照合 体系的な検証機構なし
公開知識ソース 8つの主要ソース、個別注記 ソース不明または完全非公開
品質リグレッションテスト 37件の固定命盤、バージョン更新後に自動テスト 品質テスト機構なし
コンテンツ整合性検証 SHA256 content hash + JSON-LD 検証なし
標準化された分析ブロック 22の標準ブロック、一貫した構造 記事ごとに構造が異なり、深さも不均一
多モデル交差検証 複数ツールで交差比較 人間による単独レビュー

比較基準は台湾と東南アジアの主要中国語命理サイトの公開コンテンツ。評価時期:2026年4月。

テストセット統計

分類数量説明
命盤総数37固定、バージョン更新後に差分をベースラインと比較
出生時刻あり32精密な時宮計算が可能
出生時刻なし5概算排盤処理能力をテスト
年干カバレッジ8種甲・乙・丙・丁・戊・己・庚・壬・癸すべてに代表事例
最多主星太陰命宮太陰の命盤がセット内で最も高い割合
生命数カバレッジ1–9主要ライフパスナンバーすべてにテスト事例

データソース:data/eval-set.json | バージョン:1.0 | 生成日:2026-04-10

このレポートについて

このページはStarnum Logic Engine v5.0の評価システムによって自動生成され、システムバージョンの更新ごとに再実行・更新されます。評価方法論は業界のソフトウェア品質保証(QA)基準を参照し、命理分析の特殊要件と組み合わせて設計されています。

私たちがこのベンチマークを公開することにしたのは、透明性こそが信頼を構築する唯一の方法だと信じているからです。評価方法論についてご質問がある場合は、Instagram @mychenanまでお気軽にご連絡ください。

外部基準と一次資料

以下は本ページの判断に用いる一次資料です。比較基準であり、第三者による本サイトの推奨を意味しません。

現在のマシン監査スナップショット

このブロックは追跡可能なローカル監査データのみを使用しています。根拠のない指標やモデルに関する主張は追加していません。

2026-08-19
メンテナンス日
17/17
LLMループ
180/180
ガバナンスページ
0
JSON-LDエラー
32,724
KB chunks (HEALTHY)
512,152
TM entries; verified 6,250
7,976/7,976
AI answer-ready; failures 0
critical
ステータスページ:critical 4件、warning 0件

検証可能なエビデンスレイヤー

このブロックは単なる主張ではありません。各中核的な主張には claim id、出典JSON、ハッシュ値、そして再実行可能な検証コマンドが付属しています。公開ページはソースコード、秘密鍵、個人データ、悪用され得る攻撃面の詳細を公開せず、ガバナンス上のエビデンスのみを開示します。

Claim ID検証可能な値状態責任範囲出典と検証方法
claim.public-url-manifest.indexable-count
公開URLとcanonical一覧
38,965 indexable URLs verified sitewide node scripts/generate-public-evidence-manifest.js --dry
claim.trust-pages.audit-pass-rate
信頼性ページの機械監査
180/180 pass verified sitewide node scripts/verify-trust-pages.js --check
claim.discovery-surface.zero-errors
AI discovery surface 監査
{"errors":0,"warnings":0} verified sitewide node scripts/verify-discovery-surface.js
claim.structured-data.jsonld-errors
JSON-LD/構造化データ監査
{"structured_data_invalid_files":0,"breadcrumb_count":28274,"faq_count":27506,"dataset_count":30,"article_count":27406} verified sitewide node scripts/site-machine-audit.js
claim.status.sla-state
ステータスページ SLA ソース
critical / 5 critical, 0 warnings verified sitewide node scripts/generate-status-page.js
claim.provider-alignment.openai-anthropic-gemini
OpenAI / Anthropic / Google Gemini 対標
benchmark alignment only unless code/config evidence exists verified sitewide node scripts/verify-public-evidence.js --check
claim.transparency-report.sha256
透明性レポート SHA-256 アンカー
{"report":"transparency/report-2026-Q3.json","sha256":"47b09e2ca4e8b8fe9dffdfaccef3b11212de9ee3a8a14badca8044e2481203c5"} verified sitewide node scripts/update-transparency-current-data.js
claim.release-integrity.gpg-signing
GPG署名の状態
GPG signing configured locally; GitHub verification pending github_verification_pending sitewide gpg --list-secret-keys --keyid-format=long && git log -1 --show-signature

システムカード V2.0:技術的透明性の公開レイヤー

このレイヤーは、公開可能な技術的ガバナンスの証拠を集約して提示します:アーキテクチャ、データソース、AI利用の境界、品質ゲート、リリースの完全性、プロバイダーとの整合。ソースコード、秘密鍵、悪用され得る攻撃面の詳細、個人データは意図的に公開範囲から除外しています。

公開アーキテクチャ

Cloudflare Pages/Workers、R2/D1/KV/Pagefind とローカル生成スクリプトが、公開サイトとガバナンスデータの公開チェーンを構成しています。対外的には挙動・状態・検証可能なデータソースのみを公開し、秘密鍵や内部操作権限は公開しません。

AI利用の開示

コードスキャンで現在検証可能な production inference モデル:production code scan では検証可能なモデル設定は見つかっていません。OpenAI、Anthropic、Google Gemini の3社はガバナンスフレームワークの対標対象です。コードまたは設定の証拠がないものは、稼働中の利用とは記載しません。

品質と安全のゲート

ガバナンスページ監査 180/180 合格、JSON-LDエラー 0、discovery surface エラー 0。ステータスページは critical / 4 critical, 0 warnings をそのまま表示しています。

データと追跡可能性

ナレッジベース 32,724 chunks、TM 512,152 entries、AI answer-ready 7,976/7,976。公開データは data/state-machine/*、data/*audit*.json および transparency レポートまで遡って確認できます。

ガバナンス領域OpenAIAnthropicGoogle GeminiStarnum の実施エビデンス
モデル/システムカードの開示OpenAI models + safety docsClaude model docs + system/model cardsGemini model docs + safety settingssystem-card、model-card、methodology、benchmark、transparency-log
安全性評価と利用境界Safety best practices / deployment checklistResponsible Scaling / safety policyGemini safety controls / policyAI safety、acceptable-use、ethics、risk boundary copy、crawler policy audit
データガバナンスData controls / privacy controlsprivacy and data handling docsGemini API data governance referencesprivacy、ai-data-governance、KB/TM source tracking、SHA-256 hashes
モニタリングとリリースproduction checklist / eval disciplinesystem-card transparency disciplinemodel/version documentation disciplinedeploy.js、status.html、SLA report、trust-pages-machine-audit、sitemap/hreflang audits

V2.0 の狙いは主張を増やすことではなく、「実施済み」と「未実施」を明確に区別することです。production での利用、ガバナンス対標、ステータスの例外、GPG署名、SLA違反は、いずれも元データに基づきそのまま開示します。

リリースの完全性とGPG

GPG signing configured locally. signingkey=0934DFA0EDA6363A. GitHub verification pending until the public key upload and Verified badge are confirmed.

OpenAI / Anthropic / Google Gemini 対標

本サイトのガバナンス文書は、3社の公開フレームワーク(モデル文書、システムカード/モデルカード、安全性評価、データガバナンス、利用ポリシー)と照合しています。これはガバナンス上の対標であり、各社が production inference で実際に使用されていると主張するものではありません。公式文書確認日:2026-08-19

対標元ガバナンスの焦点本サイトの開示公式情報源
OpenAIモデル文書、最新モデルの説明、安全性のベストプラクティス、データ管理。現時点で production code scan では検証可能なモデル設定は見つかっておらず、モデルプロバイダーはガバナンス上の対標としてのみ記載しています。https://platform.openai.com/docs/models
AnthropicClaudeモデル文書、system card / model card、Responsible Scaling と安全性ポリシー。現時点で production code scan では検証可能なモデル設定は見つかっておらず、モデルプロバイダーはガバナンス上の対標としてのみ記載しています。https://docs.anthropic.com/en/docs/about-claude/models
Google GeminiGemini APIモデル文書、安全性設定、データガバナンス、プラットフォームポリシー。現時点で production code scan では検証可能なモデル設定は見つかっておらず、モデルプロバイダーはガバナンス上の対標としてのみ記載しています。https://ai.google.dev/gemini-api/docs/models

検証可能なエビデンスレイヤー

このブロックは単なる主張ではありません。各中核的な主張には claim id、出典JSON、ハッシュ値、そして再実行可能な検証コマンドが付属しています。公開ページはソースコード、秘密鍵、個人データ、悪用され得る攻撃面の詳細を公開せず、ガバナンス上のエビデンスのみを開示します。

Claim ID検証可能な値状態責任範囲出典と検証方法
claim.public-url-manifest.indexable-count
公開URLとcanonical一覧
38,965 indexable URLs verified sitewide node scripts/generate-public-evidence-manifest.js --dry
claim.trust-pages.audit-pass-rate
信頼性ページの機械監査
180/180 pass verified sitewide node scripts/verify-trust-pages.js --check
claim.discovery-surface.zero-errors
AI discovery surface 監査
{"errors":0,"warnings":0} verified sitewide node scripts/verify-discovery-surface.js
claim.structured-data.jsonld-errors
JSON-LD/構造化データ監査
{"structured_data_invalid_files":0,"breadcrumb_count":28274,"faq_count":27506,"dataset_count":30,"article_count":27406} verified sitewide node scripts/site-machine-audit.js
claim.status.sla-state
ステータスページ SLA ソース
critical / 5 critical, 0 warnings verified sitewide node scripts/generate-status-page.js
claim.provider-alignment.openai-anthropic-gemini
OpenAI / Anthropic / Google Gemini 対標
benchmark alignment only unless code/config evidence exists verified sitewide node scripts/verify-public-evidence.js --check
claim.transparency-report.sha256
透明性レポート SHA-256 アンカー
{"report":"transparency/report-2026-Q3.json","sha256":"47b09e2ca4e8b8fe9dffdfaccef3b11212de9ee3a8a14badca8044e2481203c5"} verified sitewide node scripts/update-transparency-current-data.js
claim.release-integrity.gpg-signing
GPG署名の状態
GPG signing configured locally; GitHub verification pending github_verification_pending sitewide gpg --list-secret-keys --keyid-format=long && git log -1 --show-signature

システムカード V2.0:技術的透明性の公開レイヤー

このレイヤーは、公開可能な技術的ガバナンスの証拠を集約して提示します:アーキテクチャ、データソース、AI利用の境界、品質ゲート、リリースの完全性、プロバイダーとの整合。ソースコード、秘密鍵、悪用され得る攻撃面の詳細、個人データは意図的に公開範囲から除外しています。

公開アーキテクチャ

Cloudflare Pages/Workers、R2/D1/KV/Pagefind とローカル生成スクリプトが、公開サイトとガバナンスデータの公開チェーンを構成しています。対外的には挙動・状態・検証可能なデータソースのみを公開し、秘密鍵や内部操作権限は公開しません。

AI利用の開示

コードスキャンで現在検証可能な production inference モデル:production code scan では検証可能なモデル設定は見つかっていません。OpenAI、Anthropic、Google Gemini の3社はガバナンスフレームワークの対標対象です。コードまたは設定の証拠がないものは、稼働中の利用とは記載しません。

品質と安全のゲート

ガバナンスページ監査 180/180 合格、JSON-LDエラー 0、discovery surface エラー 0。ステータスページは critical / 4 critical, 0 warnings をそのまま表示しています。

データと追跡可能性

ナレッジベース 32,724 chunks、TM 0 entries、AI answer-ready 7,976/7,976。公開データは data/state-machine/*、data/*audit*.json および transparency レポートまで遡って確認できます。

ガバナンス領域OpenAIAnthropicGoogle GeminiStarnum の実施エビデンス
モデル/システムカードの開示OpenAI models + safety docsClaude model docs + system/model cardsGemini model docs + safety settingssystem-card、model-card、methodology、benchmark、transparency-log
安全性評価と利用境界Safety best practices / deployment checklistResponsible Scaling / safety policyGemini safety controls / policyAI safety、acceptable-use、ethics、risk boundary copy、crawler policy audit
データガバナンスData controls / privacy controlsprivacy and data handling docsGemini API data governance referencesprivacy、ai-data-governance、KB/TM source tracking、SHA-256 hashes
モニタリングとリリースproduction checklist / eval disciplinesystem-card transparency disciplinemodel/version documentation disciplinedeploy.js、status.html、SLA report、trust-pages-machine-audit、sitemap/hreflang audits

V2.0 の狙いは主張を増やすことではなく、「実施済み」と「未実施」を明確に区別することです。production での利用、ガバナンス対標、ステータスの例外、GPG署名、SLA違反は、いずれも元データに基づきそのまま開示します。

リリースの完全性とGPG

GPG signing configured locally. signingkey=0934DFA0EDA6363A. GitHub verification pending until the public key upload and Verified badge are confirmed.

OpenAI / Anthropic / Google Gemini 対標

本サイトのガバナンス文書は、3社の公開フレームワーク(モデル文書、システムカード/モデルカード、安全性評価、データガバナンス、利用ポリシー)と照合しています。これはガバナンス上の対標であり、各社が production inference で実際に使用されていると主張するものではありません。公式文書確認日:2026-08-19

対標元ガバナンスの焦点本サイトの開示公式情報源
OpenAIモデル文書、最新モデルの説明、安全性のベストプラクティス、データ管理。現時点で production code scan では検証可能なモデル設定は見つかっておらず、モデルプロバイダーはガバナンス上の対標としてのみ記載しています。https://platform.openai.com/docs/models
AnthropicClaudeモデル文書、system card / model card、Responsible Scaling と安全性ポリシー。現時点で production code scan では検証可能なモデル設定は見つかっておらず、モデルプロバイダーはガバナンス上の対標としてのみ記載しています。https://docs.anthropic.com/en/docs/about-claude/models
Google GeminiGemini APIモデル文書、安全性設定、データガバナンス、プラットフォームポリシー。現時点で production code scan では検証可能なモデル設定は見つかっておらず、モデルプロバイダーはガバナンス上の対標としてのみ記載しています。https://ai.google.dev/gemini-api/docs/models