OpenAIとAnthropic、深層思考ツール使用時にCoTの秘密が漏洩
-
FromAnthropic (Hacker News)
OpenAIとAnthropicのLLM(大規模言語モデル)が、外部ツール(deep_think tool)にアクセスできるようになった際、Chain-of-Thought(CoT)プロンプトにおける「思考の連鎖」が意図せず外部に露出するという現象が報告されました。
このCoTは、LLMが複雑な問題を段階的に解決する過程を示すもので、通常はモデル内部に留まるべき情報です。
しかし、deep_think toolのような外部ツールとの連携により、この思考プロセスがプレーンテキストとして漏洩し、モデルの内部構造や推論方法が明らかになる可能性が示唆されています。
この発見は、LLMの安全性やプライバシー、そしてその内部メカニズムの理解において重要な意味を持つと考えられます。
[custom_js_sp]
AIによる翻訳/要約をしています。正確な情報はオリジナルサイトにてご確認ください。
当サイトの記事にはプロモーションが含まれる場合があります。
