大语言模型会在蒸馏中“夹带”自己的偏好
《自然》15日发表的一项研究显示,大语言模型(LLM)可能会将某些自己的偏好“夹带私货”传授给其他算法,即使在训练数据中清除原始特征后,这些本不需要的特征,仍可能持续存在。在一个案例中,一个模型似乎通过数据中的隐含信号,将自己对猫头鹰的偏好传递给了其他模型。该研究结果表明,在开发LLM时,需要进行更彻底的安全检查。
《自然》15日发表的一项研究显示,大语言模型(LLM)可能会将某些自己的偏好“夹带私货”传授给其他算法,即使在训练数据中清除原始特征后,这些本不需要的特征,仍可能持续存在。在一个案例中,一个模型似乎通过数据中的隐含信号,将自己对猫头鹰的偏好传递给了其他模型。该研究结果表明,在开发LLM时,需要进行更彻底的安全检查。
近日,教育部、国家发展改革委、工业和信息化部、科技部、国家数据局联合印发《“人工智能+教育”行动计划》(以下简称《行动计划》),旨在一体推进人工智能人才培养和应用创新,统筹谋划基础环境和创新生态建设,系统构建智能时代的教育体系。
算力,正成为AI时代最稀缺的“硬通货”,目前全链价格不断攀升。
人民网北京4月15日电 (记者乔雪峰)近日,以“繁荣新大众文艺,共创新时代视听”为主题第十三届中国网络视听大会开幕,吸引了众多行业人士、技术专家与青年创业者,共同探讨AI浪潮下如何以新质生产力驱动行业高质量发展。 有观点认为,会议主题中的“...
记者获悉,4月14日,工信部装备工业一司、公安部交通管理局、交通运输部运输服务司联合组织召开智能网联汽车道路测试与示范应用工作会议,部署开展自查整改,加强安全监管工作。
记者4月13日获悉,工业和信息化部近日印发通知,部署做好2026年工业和信息化质量工作。
AI驱动盈利创新高、即时零售强劲增长、国际化发展打开新局面……近日,互联网企业2025年年报进入密集披露期,腾讯、阿里巴巴、百度、京东、拼多多等大型互联网企业业绩情况备受关注。
在中国科协组织下,中国人工智能学会等16家单位共同起草的《全球人工智能治理科技社团倡议》(以下简称《倡议》)于13日正式发布。《倡议》内容主要包括确保有益、赋能民生,恪守安全、防范风险,秉持公平、促进均衡,交流互鉴、携手合作,向善传播、凝聚共识等,旨在推动建立开放、公正、包容、有效的全球人工智能治理体系。

人工智能不再只是提高效率的工具,而是成为重组生产要素、改变生产函数的重要力量。这一转变深刻影响全球实体经济运行逻辑

近日,南极冰山A23a完成末次崩解,主体部分仅剩35.2平方公里。从1986年脱离南极菲尔希纳冰架时的4170平方公里,到如今低于国际惯用的面积20平方海里(约68.6平方公里)冰山编号标准,这座曾经的世界最大冰山走完了40年生命历程。