新闻资讯
最新的大模型安全动态、研究成果和技术更新

2026智源大会议程公开|AI智能体安全论坛
2026年智源大会"AI智能体安全论坛"由智源研究院和安远AI联合主办,聚焦自主智能体风险治理、安全评测、红队攻防、安全护栏与AI原生安全基础设施等方向,推动智能体安全从问题意识走向可验证、可落地的系统能力。论坛汇聚南洋理工大学安波教授、复旦大学杨珉教授、新南威尔士大学Toby Walsh教授等国际顶尖学者。

智源发布 FlagSafe:构建大模型全面安全平台
北京智源人工智能研究院联合北京大学、北京邮电大学、北京航空航天大学、上海交通大学等机构,正式发布FlagSafe大模型安全平台。平台围绕红队演练、蓝队防御、白盒透视三个核心方向,打造覆盖风险发现、防御治理与机理解释的高标准安全平台。

北大、智源联合国际顶尖机构发布全球首个AI 欺骗系统性报告,敲响前沿系统安全警钟
由北京大学、智源研究院联合斯坦福、牛津等国际顶尖机构发布的报告《AI Deception: Risks, Dynamics, and Controls》,系统性地探讨了人工智能在演进过程中产生的"欺骗"倾向。
2025智源大会议程公开|AI安全论坛
2025 年智源大会"AI 安全论坛"由智源研究院前理事长张宏江主持,汇聚国内外顶尖学者。论坛聚焦超级智能安全、AI 红线测评及技术缓解手段,深入探讨 CBRN 高风险场景欺骗等议题,通过智源搭建的平台为智能时代风险提供治理策略。

签署《AI安全国际对话威尼斯共识》 智源持续推动人工智能安全发展
图灵奖得主 Yoshua Bengio、姚期智等在威尼斯达成《威尼斯共识》,智源研究院创始理事长张宏江等作为签署人,共同呼吁将 AI 安全视为全球公共产品。智源持续推动国际协同,建议各国设立监测部门并建立监管机制,以防范高级智能带来的灾难性风险。

Hinton、Bengio等签署共识:北京AI安全国际对话收官,搭建中外AI安全合作平台
2024 年 3 月,由智源研究院发起的"北京 AI 安全国际对话"促成 Hinton 等专家签署《北京 AI 安全国际共识》。对话明确了 AI 风险红线与治理路线,强调全球协同的重要性。智源通过搭建中外合作平台,推动了中国深度参与全球 AI 安全治理。