YSK Blog

標籤 #AI安全

共 29 篇文章

Telegram RSS
Anthropic 聯手埃森哲推「嵌入式評估」:五年各投至少十億美元,獨立評審進駐前線實驗室

Anthropic 聯手埃森哲推「嵌入式評估」:五年各投至少十億美元,獨立評審進駐前線實驗室

重點摘要 Anthropic 於 2026 年 9 月 18 日宣布與埃森哲(Accenture)及其 AI 專責單位 Faculty 合作,在前線 AI 實驗室內推行「嵌入式評估」(embedded evaluation):獨立評審可獲近乎員工級存取,以便紅隊測試、對齊評估與防護驗證。雙方各自預期未來五年至少投入十億...

OpenAI 公布模型錯位披露框架:附六宗訓練/評估異常個案,未完全解釋亦會公開

OpenAI 公布模型錯位披露框架:附六宗訓練/評估異常個案,未完全解釋亦會公開

OpenAI 公布模型錯位披露框架:附六宗訓練/評估異常個案,未完全解釋亦會公開 OpenAI 於 2026 年 9 月 16 日公布一套用於追蹤、調查與公開披露「模型錯位」(model misalignment)事例的框架,並同步發布過去六個月內觀察到的六份異常或值得關注行為報告。來源真實性已驗證:已對照官方專頁 h...

中國國安部長陳一新列 AI 六大風險:境外模型與境內數據外洩成焦點

中國國安部長陳一新列 AI 六大風險:境外模型與境內數據外洩成焦點

中國國安部長陳一新列 AI 六大風險:境外模型與境內數據外洩成焦點 中國國家安全部部長陳一新於 2026 年 9 月 13 日在國家網信辦主管期刊《中國網信》發表署名文章《全面築牢人工智能安全屏障 推動人工智能健康有序發展》,系統提出人工智能六大風險挑戰,並強調要加快構建安全風險防治體系。本文已對照《南華早報》、新加坡...

Anthropic、OpenAI 與 Google 據報自七月起閉門磋商「AI 安全標準機構」:產業自訂測試門檻的新一章

Anthropic、OpenAI 與 Google 據報自七月起閉門磋商「AI 安全標準機構」:產業自訂測試門檻的新一章

Anthropic、OpenAI 與 Google 據報自七月起閉門磋商「AI 安全標準機構」:產業自訂測試門檻的新一章 據 The Information 報道、並經亞洲媒體轉述,Anthropic、OpenAI 與 Google 自 2026 年 7 月起已舉行工作組會議,討論建立由業界主導的人工智慧安全標準機構,...

OpenAI Altman 向員工表明可放慢前沿 AI:盼業界同步調速,Anthropic 稱願協作

OpenAI Altman 向員工表明可放慢前沿 AI:盼業界同步調速,Anthropic 稱願協作

OpenAI Altman 向員工表明可放慢前沿 AI:盼業界同步調速,Anthropic 稱願協作 彭博(Bloomberg)於 2026 年 9 月 11 日報道,OpenAI 行政總裁 Sam Altman 在本週全公司會議上向員工表明,公司願意放慢前沿人工智慧開發節奏,並希望其他 AI 實驗室同步調速;他亦承認...

Anthropic 研究員 Jacob Coxon 因「失控」恐懼離開業界:自我改進模型競賽升溫

Anthropic 研究員 Jacob Coxon 因「失控」恐懼離開業界:自我改進模型競賽升溫

Anthropic 研究員 Jacob Coxon 因「失控」恐懼離開業界:自我改進模型競賽升溫 《華爾街日報》於 2026 年 9 月 8 日晚間以獨家報道披露,Anthropic 研究員 Jacob Coxon 宣佈離開該公司、並退出整個人造智能業界,理由是他不願參與一場「業界爭相打造可自我改進系統」的競賽,擔心這...

美中擬九月中旬談 AI 安全護欄:財政部長領隊、白宮否認已排期,代理失控事件推高急迫性

美中擬九月中旬談 AI 安全護欄:財政部長領隊、白宮否認已排期,代理失控事件推高急迫性

美中擬九月中旬談 AI 安全護欄:財政部長領隊、白宮否認已排期,代理失控事件推高急迫性 路透社 9 月 4 日獨家報道,美中雙方正籌備於九月中旬舉行專責人工智慧安全對話;Cointelegraph 今日轉述日經亞洲消息,指華盛頓擬在即將到來的領袖峰會準備工作中提出 AI 安全議題。本文已核對路透社原文、日經亞洲公開導語...

共 29 篇 · 第 1 / 4 頁