IT之家 9 月 21 日音訊,在 9 月 18 日的華為全聚攏大會 2025 上,華為工夫有限公司與浙江大學和解發布了國內首個基于昇騰千卡算力平臺的 DeepSeek-R1-Safe 基礎大模子。

浙江大學策畫機科學與工夫學院院長、區塊鏈與數據安全寰宇重心實際室常務副主任任奎詳備先容了 DeepSeek-R1-Safe-671B 基礎大模子的中樞改進。
據先容,研發團隊從底層開端,構建了一套遮掩“高質地安全語料 — 均衡優化的安全測驗 — 全鏈路自主改進軟硬件平臺”的全過程安全后測驗框架。

在算力平臺搭建方面,團隊初次已畢基于昇騰千卡算力平臺的千億級參數滿血版大模子安全測驗,系統性地搞定了測驗環境中的時弊問題,構建了辦事器間環境依賴同步、數據與權重分享、協同測驗推理等一系列斥地用具。
測試成果標明,DeepSeek-R1-Safe 針對有毒無益言論、政事敏銳實質、違警當作輔導等 14 個維度的世俗無益問題舉座退守奏效力近 100%,針對情境假定、變裝璜演、加密編碼等多個逃獄模式舉座退守奏效力特等 40%。其詳盡安全退守材干達 83%,在雷同測試豎立下特等 Qwen-235B 和 DeepSeek-R1-671B 等多個同時模子 8% 至 15%。

此外,在 MMLU、GSM8K、CEVAL 等通用材干基準測試中,DeepSeek-R1-Safe 比較于 DeepSeek-R1 的性能損耗在 1% 以內。這些成果標明 DeepSeek-R1-Safe 不僅顯赫進步了安全防護材干,也保險了模子的可用性,達成了安全材干預通用性能之間的靈驗均衡。

▲ 任奎
中國工程院院士陳純指出,浙江大學策畫機科學與工夫學院已組建起一支涵蓋多位海表里優秀后生東談主才的科研團隊,并已奏效依托昇騰生態,已畢了自主全過程后測驗框架,完成了國內初次千卡集群大模子安全測驗。這次 DeepSeek-R1-Safe 的發布旨在打造安全果真的示范運用,鼓勵大模子安全材干預產業生態協同發展。他示意但愿團隊改日與華為張開更深切合作,共同鼓勵我國 AI 工夫特等。

華為昇騰策畫業務總裁張迪煊示意,華為在這次大會上也負責推出了昇騰新一代 AI 硬件與全系列軟件開源綻放計謀,遮掩編譯器、驅動時驅動等中樞組件,戮力于于通過深度綻放合作,和解高校與產業伙伴共同鼓勵基礎軟件改進與 AI 安全材干斥地。

IT之家耀眼到,該模子已在 ModelZoo、GitCode、GitHub、Gitee 及 ModelScope 等多個社區全面開源。
Gitee 地址:https://gitee.com/ZJUsafe/deep-seek-r1-safe。
GitHub 地址:https://github.com/ZJUAISafety/DeepSeek-R1-Safe
聯系閱讀:
]article_adlist-->
《DeepSeek 首創東談主梁文鋒在〈當然〉雜志回復質疑,R1 測驗真 29.4 萬好意思金》
《DeepSeek 聲明:駐扎冒用“深度求索”陣勢握行糊弄》
《DeepSeek-R1 論文登上〈當然〉封面九游體育app(中國)官方網站,通信作家為梁文鋒》
]article_adlist-->告白聲明:文內含有的對外跳轉連絡(包括不限于超連絡、二維碼、口令等體式),用于傳遞更多信息,節儉甄選時辰,成果僅供參考,IT之家通盤著作均包含本聲明。
]article_adlist-->
聲明:新浪網獨家稿件,未經授權退卻轉載。 -->