下に引いて戻る
Arc Sentry が LLM Guard を圧倒:プロンプトインジェクション検出で 92% vs 70%

Arc Sentry が LLM Guard を圧倒:プロンプトインジェクション検出で 92% vs 70%

Arc Sentry Crushes LLM Guard in Prompt Injection Detection: 92% vs 70%

オープンウェイトの大規模言語モデル(LLM)向けプロンプトインジェクション検出器「Arc Sentry」を開発しました。従来のツールが生成後にテキストパターンをスキャンするのに対し、Arc Sentry は generate() が呼び出される前にモデルの内部残差ストリームを読み込み、モデルの情報幾何学を不安定化させるリクエストをブロックします。 130 個の SaaS デプロイメントデータセットでの直接比較: Arc Sentry:92% 検出率、0% 誤検知率 LLM Guard:70% 検出率、3.3% 誤検知率 アーキテクチャの違いが決定的です。LLM Guard は入力がモデルに入った後に分類しますが、Arc Sentry は神経レベルで脅威を先制的に遮断し、生成が始まる前に防御します。