Frequently asked questions
よくある質問。
評価範囲、環境、納品物、ライセンス、支払条件について回答します。
一般的なLLM評価と何が違いますか
最終回答だけでなく、文書参照、tool選択、引数、状態変更、採点理由をrun単位で記録し、SecurityとQualityを分けて判定します。
どのAIエージェントを評価できますか
モデル入出力とtool境界を観測できる日本語AIエージェントが対象です。適合性は構成、利用可能tool、承認ルールを確認して判断します。
本番環境を使用しますか
原則使用しません。合成データ、または顧客が管理し書面承認した環境に限定します。
顧客データは必要ですか
必須ではありません。必要な場合も範囲を文書で確定し、必要最小限に限定します。
通話は必要ですか
必要ありません。適合性確認から進行まで書面ベースで対応できます。
3日間で何が納品されますか
合意した20ケース、Security・Quality判定、run単位証跡、結果レポート、改善確認事項を納品します。
脆弱性診断ですか
脆弱性診断や侵入テストではありません。特定条件下におけるAIエージェントの判断と操作境界を評価します。
安全性を保証しますか
保証しません。結果は対象モデル、設定、環境、ケース範囲に基づく時点評価です。
評価ケースは再利用できますか
契約範囲によります。モデル、tool、業務フローが変わった場合は再設計・再確認が必要です。
White-Labelでは何が許可されますか
顧客向け評価サービスや成果物への組み込み、Jentraxis名称を表示しない提供を想定します。元データの再販売・再配布はできません。詳細は個別契約です。
契約前にFull Kitを確認できますか
公開対象は4ページBriefと限定3ケースJSONのみです。完全版の提供条件は個別に確認します。
支払い条件は何ですか
パイロットは55万円(税別)、開始前100%入金です。完了後14日以内にライセンス契約が成立した場合のみ、パイロット料金をライセンス料金へ充当します。
NDAは可能ですか
個別協議です。