·23 views·しんたろー
Claudeの出力に不可視の透かしが導入された理由。開発者がLoRAアダプターの安全性検証を急ぐべき訳
AI生成テキストの信頼性を巡る波が開発現場に押し寄せている。 AnthropicはClaudeの出力に不可視の透かしを導入した。テキストの自然さを損なわずにAI生成物であることを証明する技術だ。 開発者が警戒すべきは、その裏で進行するもう一つの問題だ。オープンソースのLoRAアダプターに潜むバックドア攻撃である。 「モデル出自の証明」と「外部アダプターの脆弱性」。信頼の二極化にどう向き合うべきか。