AMAI Mediaz
製品レビュー · AI MEDIAZ REPORT

Consensusの実測レビュー

公式情報の検証では高得点。一方で網羅性と条件厳守に課題が出ました。

公開 2026-09-19 · AI Mediaz編集部 · Benchmark v1.2-AI

総合スコア

ConsensusはT1 24.5点、T2 27.5点、T3 33.6点で、合計85.6点でした。質問に対する根拠付き回答と公式情報の照合で力を発揮しました。

T3が強かった理由

T3は高得点で、料金やデータベース規模などの主張を、与えられた公式記録へ結び付ける作業は安定していました。

T1・T2の減点要因

T2では語数制約や、与えられたカード以外の情報を足さないという条件への追従で減点が生じました。内容が妥当でも、タスク条件違反は再現性を損ないます。

向いている利用者

短い問いから研究上の見取り図を得る用途に向きます。網羅的な検索や厳密な表作成では、別手段で収録漏れとメタデータを確認すべきです。