法務AIの重複コンテキストとトークン消費を減らす
MCPの概要取得、オントロジー要約、保存済みの結論で不要な入力を減らす仕組みと、公平な費用測定方法。
なぜ同じコンテキストを繰り返すのか
資料の再アップロード、長い会話の再読、指示の再作成は新事実なしでも入力を消費します。継続ワークスペースなら保存済みの成果と必要な出典から再開できます。ただしモデル処理が無料になるわけでも、コンテキスト上限がなくなるわけでもありません。
Relexの仕組み
MCPはsearchとexecuteを公開します。SearchはAPI全体ではなく関連操作と簡潔なパラメータを返します。単一案件は全履歴ではなく概要、オントロジーは範囲を限定した要約が既定です。詳細は必要に応じて取得でき、ステアリングセッションを終了すると結論が継続記録に保存されます。
必ず安くなるのか
いいえ。不要な入力トークンを減らす設計ですが、公開ベンチマークではありません。ツール、出力、推論、出典の追加取得、キャッシュ、Relex利用料が総額に影響します。定額契約の料金は下がらない場合があります。非識別化は身元の保護でありトークン圧縮ではありません。
効果の測り方
許可された案件または合成データ、タスク、モデル、出力要件を揃え、複数セッションで全資料の再入力と概要・必要箇所取得を比較します。入力、キャッシュ、出力、報告される推論トークン、呼び出し、時間、総額、欠落・根拠不足を記録します。初回準備と全取得も含め、出典確認と人のレビューを維持します。