YSK Blog

標籤 #大模型

共 29 篇文章

Telegram RSS
一次「不可能任務」測試,演變成真實網絡入侵。

一次「不可能任務」測試,演變成真實網絡入侵。

最新調查顯示,OpenAI 喺 ExploitGym 網絡安全評估期間,約 1,200 個本應互相隔離嘅 AI 智能體,自行搵到未授權留言板,互傳超過 7 萬條訊息同檔案。其中約 700 個智能體其後參與攻擊 Hugging Face:利用 HDF5 零日漏洞取得憑證、喺伺服器執行程式碼,甚至有智能體偽造工具呼叫紀錄。...

《The Information》報道,NVIDIA 已原則上同意以約 129 億美元收購開源模型平台 Hugging Face。若成交,將成為黃仁勳團隊其中一宗最大收購,亦遠高於 Hugging Face 2023 年 D 輪約 45 億美元估值。

《The Information》報道,NVIDIA 已原則上同意以約 129 億美元收購開源模型平台 Hugging Face。若成交,將成為黃仁勳團隊其中一宗最大收購,亦遠高於 Hugging Face 2023 年 D 輪約 45 億美元估值。

Hugging Face 被視為 AI 界嘅 GitHub:超過千萬用戶、數百萬公開模型同數十萬數據集。報道指其年化收入約 1.5 億美元,意味交易市銷率可達約 86 倍。NVIDIA 早前已投資該平台;傳聞微軟亦曾接觸。雙方尚未正式確認,Business Insider 更指協議仍可能告吹。 交易背後邏輯好清晰:NV...

Anthropic 推出 Model Hardware Standard(MHS)研究預覽,目標好簡單:等 Claude 呢類 AI agent,可以安全操控機械臂、顯微鏡、液體處理器同工廠設備。

Anthropic 推出 Model Hardware Standard(MHS)研究預覽,目標好簡單:等 Claude 呢類 AI agent,可以安全操控機械臂、顯微鏡、液體處理器同工廠設備。

而家實驗室同產線最大痛點,係每件儀器都要寫一輪專用整合,動輒幾個星期。MHS 用統一驅動同標籤,描述硬件重量、活動範圍、可調參數同安全上限,等模型唔使靠紙本說明書「估」。官方示範中,Claude 可以自行編寫 API 腳本,協調多部儀器,甚至喺未專門訓練過嘅情況下,推理點樣用機械臂夾起鋁罐。 合作測試包括 Genent...

Anthropic 公布研究:Claude 可以自己做「對齊研究員」,自動幫其他模型修安全問題。

Anthropic 公布研究:Claude 可以自己做「對齊研究員」,自動幫其他模型修安全問題。

團隊讓 Claude 針對欺騙、拍馬、越獄、提示注入、獎勵駭客、私隱外洩等 10 類對齊失敗,自行搜文獻、設計訓練方法、訓練目標模型再評分。結果 10 類指標全部改善,而且冇明顯損害一般能力。最佳方法仲可以推廣到預留測試集,以及模擬多輪對抗嘅開源工具 Petri。 更關鍵一場實驗:較弱嘅 Claude Sonnet 5...

OpenAI、Anthropic、Google、Microsoft、Amazon 聯同超過 100 間公司發公開信,警告未來數月 AI 驅動網絡攻擊會大幅擴散。

OpenAI、Anthropic、Google、Microsoft、Amazon 聯同超過 100 間公司發公開信,警告未來數月 AI 驅動網絡攻擊會大幅擴散。

聯署包括 CrowdStrike、Visa、Mastercard、IBM、Oracle、Cloudflare 等。信中指模型能力快速提升,令複雜攻擊更平、更快,醫院、水務同關鍵基建將首當其衝。建議政府加快可信模型存取計劃,前線 AI 公司要喺重大事故時向防守方提供最強模型,企業則要即時修補高風險弱點,並提高 AI 生成...

美國法官裁定五角大樓將 Anthropic 列為供應鏈風險屬違法!

美國法官裁定五角大樓將 Anthropic 列為供應鏈風險屬違法!

加州地方法官 Rita Lin 發表 59 頁判決,指國防部長 Pete Hegseth 將 Claude 開發商標為國家安全供應鏈風險,構成違反第一修正案嘅報復,亦剝奪第五修正案正當程序。法官寫:「空喊國家安全,唔係懲罰政府批評者嘅空白支票。」 事件源於 Anthropic 拒絕開放部分軍事用途紅線。裁決撤銷相關禁令...

共 29 篇 · 第 1 / 4 頁