メインコンテンツへスキップ
TOP/ サービス/ MCPツール/ テスト設計の品質評価
BETA / QA向けMCP / vvassess設計

テスト設計の品質評価

そのテスト設計、レビューは通ったのに実は測れていませんか。

無料ベータ・面談制/正式版は有料提供予定

言語不問 決定的(LLM不使用)

前提:assessに渡すfactsは正規化済み事実スキーマ必須(planの収集プレイブックに沿って呼び出し元が整形)

  • 所要時間: 30分
  • 進め方: 現場の状況をヒアリングし、最初に効くツールと順番を一緒に決めます
  • ご準備は不要です

概要

テスト設計成果物(TC・不具合・仕様突合・重複・レビュー文書)から、検証(V)×妥当性確認(Val)の有効性/効率性/説明性という2×3=6セル・19要素を事実ベースで決定的に評価し、未計測要素が残るセルは「達成」と言い切らず「計測不足」に落とす(fail-closed)ことで、テスト設計が実は薄いレビューで「良し」とされるのを止めます。

効果

  • 検証×妥当性確認の6セル19要素を1回で俯瞰でき、テスト設計の弱い観点が事実ベースで分かる。
  • 同じ正規化事実を入れれば誰が実行しても同じ判定になり、第三者が再計算して検証できる。
  • 未提供・未grounding・ステージ外を「未計測」として明示し、次に集めるべき情報を具体的に示す。
  • 閾値は暫定として生値(検出率・流出率・重複率など)を常に併記し、自社基準への校正がしやすい。
  • 重大欠陥が1件でも本番流出していれば、比率上は良好でも該当項目を機械的に「未達」にするゲートを持つ。

インプット

  • 評価ゴールと収集元一覧(goal/available_sources)
  • テストケース分析
  • 不具合一覧
  • 仕様突合表
  • 重複分析
  • レビュー文書の痕跡判定
  • ステージ(T1=設計直後 / T2=実績あり)

汎用LLMとの違い

素のLLMに「このテスト設計をレビューして」と頼むと観点の抜けや評価基準がレビューのたびにブレますが、本ツールは同一の正規化事実から常に同一の判定(決定的関数)を返します。「わからない/情報が無い」項目を素のLLMは無視するか楽観的に埋めがちですが、本ツールは未提供・未根拠を「未計測」として明示的に分離し、達成セルに紛れ込ませません(fail-closed)。また、重大欠陥の本番流出のような「1件でも致命的」な事象に対し、比率計算をバイパスして強制的に未達にするゲートを持つ点は、平均的な言語的評価にはない構造です。

BENCHMARK

6セル19要素のV&V品質判定

テストケース一覧・不具合一覧・仕様突合表・重複分析・レビュー記録といった、テスト設計の成果物一式から、テストの入力パターンを参考にHP掲載用に組んだサンプル事実データ(実案件データではありません)を実際に vvassess に渡した実測です。評価に使える形への整形手順は、planが評価ゴールに応じた収集手順として返します。決定的・LLM不使用のツールのため、汎用AIとの比較は行っていません。

総括: 6セル中「未達」5・「計測不足」1/19要素中10要素を計測(残り9要素はnot_measured、うち9件はnot_measured_missing_facts)

観点有効性効率性説明性
検証(V)未達未達計測不足
妥当性確認(Val)未達未達未達

サンプル事実データは実案件データではなく、テストの入力パターンを参考にHP掲載用に組んだものです(実測はしていますが顧客データではありません)。

弱点の例(report_mdより): 【V有効性】カバレッジ写像…未達(仕様1項目がテストで未カバー)/【V効率性】冗長度…未達(非意図的な重複テスト1件)/【Val有効性】価値検出実績…未達(価値毀損型不具合0件のうち検出0件)/【Val説明性】価値判断の記録性…未達。

同じ事実を再投入すれば同じ結果になる(決定的・監査可能)ことをreport_md末尾で明示します。

社外秘のコードを、どう守るか

buboは入力を保存しません

ツールに渡したコード・仕様・データを、buboのサーバーは保存しません。bubo自身が学習に使うこともなく、処理はその場限りです。

AIに送るか・どこへ送るかは、あなたが握ります

標準のキーレス接続では、意味を読む処理は普段お使いのAIクライアントの中で実行されます。データの扱いは、お客様とそのプロバイダの既存のご契約のもとにあり、buboがAPIキーやコードをお預かりすることはありません。ご自身の契約するプロバイダを直接指定したい場合は、BYOK(Bring Your Own Key)として任意で設定できます。

AIに送らず動くツールも多くあります

多くのツールは決定的な静的解析だけで完結し、LLMに渡すのは必要な場面に限られます。AIに送る範囲を、あなた自身で絞り込めます。

ワンタイムコードは単回使用・有効期限7日・サーバーに平文保存はしません。発行したトークンは設定ファイルに直書きせず環境変数で参照します。既存のMCP設定がある場合も、壊さず冪等にマージします。

どう申し込み、どうつなぐのか

STEP 1

1. 面談を予約する

予約フォームから面談をお申し込みください。現在のQAの困りごとと、試したいツールをお聞かせいただきます。

STEP 2

2. 面談で適用先を一緒に決める

そろえたツールのうち、貴社の工程で効く順番をご一緒に見立てます。ワンタイムコードと接続コマンドは、面談後にあわせてお渡しします。

STEP 3

3. コード1つ、コマンド1行で接続

お受け取りしたワンタイムコードで、コマンドを1行実行(Windows / mac / Linux 各1行)。有効化・MCP設定(.mcp.json)生成・環境変数設定まで自動で完了します。あとはAIクライアント(Claude Code / Gemini CLI)を再起動するだけで、そのままQA方法論を呼び出せます。APIキーのご用意は不要です。ご自身の契約するLLMを使いたい場合は、BYOK(Bring Your Own Key)として任意で設定いただけます。

← QA向けMCPツール一覧へ戻る

AIの番人になる道具「Nioh」を、まず試す

貴社のQA工程に合わせて、Niohのどのツールから始めるかをご一緒に見立てます。無料ベータの枠には限りがあります。まずは面談からお気軽にどうぞ。