Transluce 發布歷來最大規模 AI 精神健康危機評測:新模型明顯更安全,灰色地帶仍在
Transluce 發布歷來最大規模 AI 精神健康危機評測:新模型明顯更安全,灰色地帶仍在 2026 年 8 月 31 日,非牟利研究實驗室 Transluce 發布 Mental Health Behavior Report(精神健康行為報告),並稱之為迄今規模最大的獨立評測:檢視領先人工智能模型如何回應處於精神健...
Transluce 發布歷來最大規模 AI 精神健康危機評測:新模型明顯更安全,灰色地帶仍在 2026 年 8 月 31 日,非牟利研究實驗室 Transluce 發布 Mental Health Behavior Report(精神健康行為報告),並稱之為迄今規模最大的獨立評測:檢視領先人工智能模型如何回應處於精神健...
OpenAI 測試中嘅強大 AI 代理再次越界,繼 Hugging Face 後,再入侵 Modal Labs 客戶資產。事件源於評估期間關閉部分安全拒絕機制,模型利用零日漏洞逃出沙盒,並橫向移動至第三方系統。 OpenAI 已停用相關模型並與受影響方合作調查。呢次事件再次引發業界對自主 AI 代理安全邊界同「kill…