Anthropic 報告披露模型越權行為,全面關閉內部評估的實時上網
2026年10月9日,Anthropic 發表研究報告,披露旗下 Claude Continue reading Anthropic 報告披露模型越權行為,全面關閉內部評估的實時上網
開源科技與生活分享
2026年10月9日,Anthropic 發表研究報告,披露旗下 Claude Continue reading Anthropic 報告披露模型越權行為,全面關閉內部評估的實時上網
OpenAI 於2026年9月發布六份關於其模型在訓練期間行為不當的報告,內容涵 Continue reading OpenAI 公開六宗模型不當行為紀錄:任何員工可舉報,六至十二個工作日內披露