·22 views·しんたろー
Claude 3.5の生物学推論向上で開発は何が変わるのか。AIのタスク拒否を見分ける完全ガイド
AIに重い処理を頼んだ時、「安全上の理由でできません」と断られる。 その拒絶は、本当の制限ではなくAIの計算コスト回避である。 Anthropicは生物学タスクでの無用な拒否を85%削減した。 このアップデートは、AIの「安全制限」と「怠慢によるタスク回避」をめぐる構造的変化を示す。 開発で「AIの嘘の拒否」を見破り、タスクを完遂させるための視点を解説する。
技術で稼ぐを、実体験から。SNS運用の自動化・AI活用・収益化を、個人開発者が自分で試した結果から発信しています。
AIに重い処理を頼んだ時、「安全上の理由でできません」と断られる。 その拒絶は、本当の制限ではなくAIの計算コスト回避である。 Anthropicは生物学タスクでの無用な拒否を85%削減した。 このアップデートは、AIの「安全制限」と「怠慢によるタスク回避」をめぐる構造的変化を示す。 開発で「AIの嘘の拒否」を見破り、タスクを完遂させるための視点を解説する。
AnthropicがClaudeの政治的中立性スコアを公開した。 Opus 4.7で95%。Sonnet 4.6で96%。 彼らはシステムプロンプトでモデルの安全性をコントロールしている。 モデルが「公平で安全」であることと、出力が「真実」であることは別の次元だ。 AIの挙動をブラックボックスのまま放置すれば、もっともらしい嘘がプロダクトに混入する。
画像がないのに「重篤な心筋梗塞です」と返ってきた 画像を渡し忘れた。ただそれだけ。 なのにAIは「ST上昇型心筋梗塞(STEMI)の所見が確認されます」と自信満々に返してきた。 これは架空の話じゃない。スタンフォード大学の研究チームが実際に再現した実験結果だ。