- 2026.10.08
-
ソフトウェア品質保証
生成AI品質評価ツール「GENFLUX Evaluation」を販売開始
~ 生成AI・RAGの品質を可視化し、安全で信頼性の高いAI運用を実現 ~
テクマトリックス株式会社(本社:東京都港区、代表取締役社長:矢井隆晴、以下「テクマトリックス」)は、株式会社Elith(本社:東京都文京区、代表取締役社長:井上顧基)と戦略的パートナーシップの一環として販売代理店契約を締結し、同社が提供する生成AI品質評価ツール「GENFLUX Evaluation」の販売を2026年10月8日より開始いたします。
両社は、企業における生成AIの「安全で信頼できる実装と運用」を共通のテーマに、製品の提供、導入・カスタマイズ支援体制の構築、AIセーフティ分野での知見共有と技術検証、共同でのマーケティング活動を柱とする戦略的パートナーシップを締結しました。今回のGENFLUX Evaluationの販売開始はその第一弾であり、今後も両社の強みを組み合わせ、お客様の生成AI活用を評価設計から運用定着まで一貫して支援してまいります。
世界的に生成AI(大規模言語モデル:LLM)の業務活用が加速する一方で、企業におけるLLMの利用は、回答品質のばらつき、ハルシネーション(事実に基づかない情報を生成する現象)、機密情報の露出、コンプライアンス、プロンプトの変更やモデル更新による挙動変化など、複合的なリスクを伴います。こうした課題は、事業継続性や顧客信頼に直結するだけでなく、企業価値に関わる重要な経営課題となっており、各企業は「安全かつ再現性のある生成AI運用」を実現するための体制整備を進めています。そのような状況において、生成AIを活用したアプリケーション開発・運用の現場では、モデルやプロンプト、RAG(検索拡張生成)構成の品質を継続的に測定・改善するための「評価(Evaluation)」の重要性が急速に高まっています。
このような市場の動向から、テクマトリックスは、生成AIの回答品質や安全性、生成AIアプリケーションのリスク評価を高精度に支援する、GENFLUX Evaluationの販売を開始することにいたしました。
GENFLUX Evaluationは、生成AI・RAG・AIエージェントの回答品質を評価し、改善ポイントまで可視化するAI品質評価・運用基盤です。回答品質、安全性、パフォーマンス、レッドチーミング(敵対的テスト)、コンプライアンス(AI事業者ガイドライン/EU AI Act)といった多角的な視点から評価を行い、企業が安心してAIを使い続けられる運用体制の構築を支援します。標準テンプレートによる評価に加え、業界・業務・AIユースケースに応じた評価項目・評価基準の個別設計や、評価の専門家による改善支援にも対応しています。
テクマトリックスは、今回のElith社製品の戦略的パートナーシップを通じて、長年培ってきたソフトウェア開発支援の知見を活かし、GENFLUX Evaluationをすべてのお客様のAI開発における課題を解決するソリューションとして強力に推進してまいります。今後、販売、マーケティング、ユーザーサポート活動を一層強化し、お客様の安全なAI活用と企業価値向上に貢献します。
両社は、企業における生成AIの「安全で信頼できる実装と運用」を共通のテーマに、製品の提供、導入・カスタマイズ支援体制の構築、AIセーフティ分野での知見共有と技術検証、共同でのマーケティング活動を柱とする戦略的パートナーシップを締結しました。今回のGENFLUX Evaluationの販売開始はその第一弾であり、今後も両社の強みを組み合わせ、お客様の生成AI活用を評価設計から運用定着まで一貫して支援してまいります。
世界的に生成AI(大規模言語モデル:LLM)の業務活用が加速する一方で、企業におけるLLMの利用は、回答品質のばらつき、ハルシネーション(事実に基づかない情報を生成する現象)、機密情報の露出、コンプライアンス、プロンプトの変更やモデル更新による挙動変化など、複合的なリスクを伴います。こうした課題は、事業継続性や顧客信頼に直結するだけでなく、企業価値に関わる重要な経営課題となっており、各企業は「安全かつ再現性のある生成AI運用」を実現するための体制整備を進めています。そのような状況において、生成AIを活用したアプリケーション開発・運用の現場では、モデルやプロンプト、RAG(検索拡張生成)構成の品質を継続的に測定・改善するための「評価(Evaluation)」の重要性が急速に高まっています。
このような市場の動向から、テクマトリックスは、生成AIの回答品質や安全性、生成AIアプリケーションのリスク評価を高精度に支援する、GENFLUX Evaluationの販売を開始することにいたしました。
GENFLUX Evaluationは、生成AI・RAG・AIエージェントの回答品質を評価し、改善ポイントまで可視化するAI品質評価・運用基盤です。回答品質、安全性、パフォーマンス、レッドチーミング(敵対的テスト)、コンプライアンス(AI事業者ガイドライン/EU AI Act)といった多角的な視点から評価を行い、企業が安心してAIを使い続けられる運用体制の構築を支援します。標準テンプレートによる評価に加え、業界・業務・AIユースケースに応じた評価項目・評価基準の個別設計や、評価の専門家による改善支援にも対応しています。
テクマトリックスは、今回のElith社製品の戦略的パートナーシップを通じて、長年培ってきたソフトウェア開発支援の知見を活かし、GENFLUX Evaluationをすべてのお客様のAI開発における課題を解決するソリューションとして強力に推進してまいります。今後、販売、マーケティング、ユーザーサポート活動を一層強化し、お客様の安全なAI活用と企業価値向上に貢献します。
GENFLUX Evaluationの機能・特長
RAGからAIエージェントまで、生成AIシステムの品質・安全性を評価
GENFLUX Evaluationは、社内文書を検索して回答するRAGやチャットボット、AIエージェントを対象とした評価プラットフォームです。回答の正確性や質問との関連性、参照情報との整合性に加え、機密情報の漏えい、不適切な出力、社内ルールへの適合性などを多面的に評価します。人手では確認に時間がかかる生成AIのテストを効率化し、導入判断や品質改善を支援します。
図1.生成AIの品質・安全性を一覧で確認 ※画面は評価例です。
テストの作成・実行から結果の可視化までを一元化
テスト質問の生成、評価対象からの回答収集、評価の実行、結果の可視化を一つの環境で行えます。評価スコアと個別の回答を確認し、問題のあるケースを特定できます。モデルやプロンプト、参照文書の変更後も同じテストで繰り返し評価することで、改善効果や品質低下を確認できます。
図2.回答ごとの評価スコアと問題の理由を可視化 ※画面は評価例です。
レッドチーミングで、通常のテストでは見つけにくいリスクを検証
悪意のある指示によってAIの動作を誘導する「プロンプトインジェクション」や、安全上の制約を回避する「脱獄」などを想定した攻撃テストにより、生成AIの安全性を検証します。通常の利用を想定した品質評価と組み合わせ、意図しない回答や情報漏えいにつながる弱点の発見を支援します。
図3.攻撃シナリオ別の評価結果を確認 ※画面は評価例です。
業務固有の評価基準と専門家によるカスタマイズ支援
標準の評価機能に加え、エンジニアが顧客の業務やシステムに合わせた評価設計・接続・カスタマイズを支援します。業界特有の用語、社内規程、想定する利用シナリオを評価に反映し、業務上重要な品質とリスクを検証します。AIの研究開発とローカルAI環境の構築で培った知見を生かし、顧客固有の要件に応じたレッドチーミングや、導入環境に合わせた構築を支援します。販売開始日
- 販売開始日:2026年10月8日
- 出荷開始予定日:2026年10月8日
GENFLUX Evaluationの詳細はこちらをご参照ください。
このページをPDFファイルでご覧いただく場合は、下の[ダウンロード]をクリックしてください。
関連するサービス・製品
本件についてお問い合わせ
テクマトリックス株式会社
東京本社ソフトウェアエンジニアリング事業部
03-4405-7853
- メールでのお問い合わせ
- genflux-info@techmatrix.co.jp