LexiMetrics
ストックにはログインが必要です
1つのプロンプトを実行して主要モデルを評価し、最適なモデルを選ぶ。
Artificial Intelligence
Productivity
概要
LexiMetricsは、1つのプロンプトを複数AIモデルで実行し、出力を横並びに比較して、実測指標で評価するツールです。対応モデルを同条件で比較でき、BLEU/ROUGE-L/BERTScore/COMET/METEOR/G-Eval などの指標を活用します。ゴールデンリファレンスを使った根拠ある採点や多言語での翻訳評価にも対応。
主な特徴
- 1回の実行で複数モデルを比較
- 業界標準の評価指標を使用
- 自分の「ゴールデン reference」で正確性を測定
- 複数言語の翻訳評価に対応
使い方のヒント
- 自分のプロンプトをテスト
- ゴールデンアンサーをアップロード
- システムプロンプトの調整
投票数: 0