DeepSeek HarnessにClaude風の中国向けリスク管理とUXプラグインが登場
-
FromClaude (Hacker News)
このニュースは、DeepSeek Harness(DSH)向けの「dsh-claude-ux」というWebプロファイルプラグインについて解説しています。
このプラグインは、AnthropicのClaude AIの2つの主要な機能、すなわち「地域リスク管理」と「対話の自主終了」を模倣し、DSH環境でローカルに実行されます。
地域リスク管理では、ユーザーの地域(タイムゾーン、言語設定、IPアドレス、プロキシ等)を検出します。特定の地域(例:中国)のユーザーを検出してリスク管理を行う「Claude原版」の挙動と、逆に非中国ユーザーを検出してリスク管理を行う「反向風控」の両方が可能です。リスクに該当した場合、段階的なペナルティ(拒否メッセージ、会話終了、システムプロンプト注入)が適用されます。
対話の自主終了機能は、ユーザーが執拗な罵倒や有害コンテンツを要求した場合に、警告を経て対話を自主的に終了させます。ただし、自傷・他傷のリスクメッセージにはこの機能は適用されません。罵倒と有害コンテンツの検出は、単語リストによる高速判定と、LLM(大規模言語モデル)による文脈判断を組み合わせて行われます。
さらに、システムプロンプトの日付形式やUnicodeの特定の文字バリアントを利用した「隠写通道」による情報エンコード機能も搭載されています。
設定画面では、これらのリスク管理や自主終了機能のオン/オフ、目標地域、ペナルティ設定、LLMの選択などを細かくカスタマイズできます。デフォルト設定では、IPアドレスの外部サービスへの問い合わせなどは行われず、プライバシーに配慮されています。
インストールは簡単なコマンドで行え、既存のDSH環境に容易に統合できます。
AIによる翻訳/要約をしています。正確な情報はオリジナルサイトにてご確認ください。
当サイトの記事にはプロモーションが含まれる場合があります。
