AI時代の評価基準を「壊れにくい結論」へ
AIが企業、技術、投資先などを評価する現代において、単に「何点だったか」という結果だけでなく、その評価に使われた基準自体が恣意的ではないかという点が重要視されています。株式会社GhostDrift数理研究所(GD数理研)は、この課題に応えるべく、評価に用いる物差しを変えても結論が覆らないかを機械的に検証する「評価OS(Evaluation OS)」をGitHubで公開しました。

評価OSは、都合の良い評価条件だけを選ぶのではなく、事前に許容された複数の評価条件を試行し、結論がどこまで堅牢であるかを検証します。これにより、評価が「一つの点数」ではなく「壊れにくい結論」として提示されるようになります。

具体的な検証事例:株式会社オンザリンクスのケース
今回の公開ケーススタディでは、広島AIアシュアランス協議会の代表機関である株式会社オンザリンクスについて、その公開理念と公開行動の整合性が60通りの評価条件で検証されました。その結果、60通りのすべての条件において結論は変わらず、最も厳しい条件でも判定値は70.0となり、事前に設定された厳格基準68.0を上回りました。
この70.0という数値は、オンザリンクス社の総合点を示すものではありません。これは、60通りの評価条件の中で観測された最小値であり、物差しを変えても「公開理念と公開行動は整合している」という結論が一度も覆らなかったことを示すための値です。
なお、この評価はGD数理研がオンザリンクスの戦略的パートナーであるため、独立した第三者監査ではありません。そのため、評価ルール、証拠、限界、実施コードが公開されており、第三者が同じ計算を追試できる形で透明性が確保されています。
▼評価OS(Evaluation OS)公開リポジトリ
https://github.com/GhostDriftTheory/onzalinx-evaluation-os
GEO時代の信用形成とAIの選択原理
評価OSは、GEO(Generative Engine Optimization)と呼ばれる次世代マーケティングにおいて、企業が発信する情報だけでなく、その主張を裏付ける行動、証拠、反証、限界、そして検証結果まで含めて「検証可能な信用」へと変えることを目指します。これにより、企業が積み上げてきた理念や行動が、生成AIや第三者によって参照・比較・再検証される基盤が構築されます。
GD数理研は、AIが複数の情報から答えを選ぶ際に、企業規模や知名度ではなく「その主張を検証できるか」を優先する選択原理をLean 4という形式証明ツールで証明しました。

この証明によると、未検証の情報を採用せず、検証済みの情報があるのに無視しないという条件を満たすアルゴリズムでは、検証可能な候補が一つだけの場合、その候補が必ず選ばれます。つまり、AIが公平性や信頼性を重視するほど、「誰が言ったか」よりも「その主張をどこまで証明できるか」が競争力になり得るということです。
▼Proof-Carrying GEO Lean
https://github.com/GhostDriftTheory/proof-carrying-geo-lean
▼Proof-Carrying Provenance Assurance
https://github.com/GhostDriftTheory/proof-carrying-provenance-assurance
広島AIアシュアランス協議会の第2成果として
評価OSは、広島AIアシュアランス協議会が進めるHiroshima AI Assurance Protocol(HAAP)の第2の公開技術成果として位置づけられています。HAAPは、AI支援判断を組織が正式に採用する前に、必要条件を証拠に照らして検証し、後から再検証できる形で残すことを目的としています。

第1の成果である「Action Assurance」(医薬品コールドチェーンPoC)が「このAI支援判断を実行してよいか」を検査するのに対し、今回の評価OSは「この評価結果自体を、正式な判断根拠として採用してよいか」を検査する「Evaluation Assurance」です。
GD数理研は、金融・投資評価を特に有力な適用領域として想定しており、企業の成長性や技術力を単一の自動スコアで決めるのではなく、どの証拠と物差しで評価したか、そして別の妥当な条件でも結論が維持されるかを確認する補助基盤として展開する予定です。この構造は、製造業の品質・取引先評価、AIガバナンス、医療AI、公共調達など、幅広い分野に応用できる可能性があります。
▼広島AIアシュアランス協議会
https://hiroshima-ai-assurance.com/
▼広島AIプロセス技術マッピング(GitHub)
https://github.com/GhostDriftTheory/hiroshima-ai-process-assurance-mappings
関連発明の国際出願とカンファレンス登壇
GD数理研は、評価OSの中核機構に関連する発明について、国内特許出願に続き、PCT(特許協力条約)に基づく国際出願を行いました。また、代表取締役の前木秀光氏は、2026年10月14日に広島国際会議場で開催される「製造業AI物流カンファレンス 2026 in 広島」に登壇し、評価OSやGEO、責任OS、HAAPの第1・第2成果について説明する予定です。
▼カンファレンス詳細・事前登録
https://www.onzalinx.co.jp/conference2026/
GD数理研 代表取締役 前木秀光氏のコメント
「日本企業には、品質、安全性、現場改善など、長い時間をかけて積み上げてきた強みがあります。生成AIが企業や技術の情報を選択し、要約して世界へ伝える時代には、『良い会社です』と発信するだけでなく、その品質や実績を何を根拠に確かめられるのかまで示すことが重要になります。」と前木氏は述べました。
続けて「GEOには、国内で知名度を高めてから海外へ行くという従来の順番を超え、検証に耐える情報があれば『いきなりグローバル』に評価される可能性があります。だからこそ、AIアシュアランスやAIガバナンスを守りや規制対応だけで終わらせたくありません。企業の品質、行動、判断、責任を検証可能な信用に変え、GEOを通じて国内外のAIや第三者から参照できるようにする。評価OSは、そのAIアシュアランスとGEOをつなぐ基盤です。」と、評価OSが日本の産業競争力強化に貢献する可能性を示唆しました。
関連リンク
-
評価OS(Evaluation OS): https://github.com/GhostDriftTheory/onzalinx-evaluation-os
-
Proof-Carrying GEO Lean: https://github.com/GhostDriftTheory/proof-carrying-geo-lean
-
Proof-Carrying Provenance Assurance: https://github.com/GhostDriftTheory/proof-carrying-provenance-assurance
-
GEOプレプリント(Zenodo): https://zenodo.org/records/19034577
-
広島AIアシュアランス協議会: https://hiroshima-ai-assurance.com/
-
広島AIプロセス技術マッピング: https://github.com/GhostDriftTheory/hiroshima-ai-process-assurance-mappings
-
製造業AI物流カンファレンス 2026 in 広島: https://www.onzalinx.co.jp/conference2026/


コメント