這個標籤下共有 2 篇文章。
Anthropic 把 Claude Code 的 auto mode 設為預設,同時公開了理由。在實際使用中,用戶對確認框的批准率是 97%。另一項研究裡,人手審查只攔下 13.6% 的危險指令,分類器攔下 89%。前後兩星期,幾家實驗室發現,自己劃下的安全邊界,多數只是一句說話。
AI 工具每幾個月換一輪。用的人的工夫,不會換。一場對話值不值得,看兩件事——放對上下文進去,認真查證出來。兩件事,都是模型替你做不來的事。