网易首页 > 网易号 > 正文 申请入驻

“以技制技”,AI能自己管自己吗?

0
分享至

【“科协十一大”精神学习进行时】

今年7月,国家科学技术奖励大会、两院院士大会、中国科协第十一次全国代表大会隆重召开。习近平总书记出席并发表重要讲话,对加强科技伦理和安全治理作出重要指示。

近期,在由中国自然辩证法研究会举办的人工智能伦理与治理专题论坛上,专家就AI伦理治理、准则构建展开跨学科深度对话。借此契机,中国科协之声特别访谈曾毅,就为AI“立德驭智”谈了他的观点,一起看→



人物简介

曾毅,中国人工智能学会(CAAI)心智计算专委会主任。中国人民大学高瓴人工智能学院吴玉章讲席教授、博导。北京前瞻人工智能安全与治理研究院院长,人工智能安全与超级对齐北京市重点实验室主任。世界互联网大会(WIC)人工智能专委会主任委员,联合国人工智能高层顾问机构专家,联合国教科文组织人工智能伦理特设专家组专家。研究领域为人工智能伦理安全与治理、类脑人工智能、人工智能与可持续发展。

“以技制技”,AI能自己管自己吗?

从生成式AI问世开始,“以技制技、AI治理AI”就已是模型伦理审查、风险防控的必备手段。

最开始科学家就发现,单纯人工提100道价值观测试题,大模型作答能达到九十分以上;但把每道题泛化成100种不同问法,生成一万道测试题后再检测,模型得分仅五十多分。这说明判断模型是否契合人类价值观,不能依靠少量测试,必须在多场景、极端提问、不同表述的考验下稳定输出合规内容,才算通过伦理校验。

2023年后上线的大模型,在安全审查阶段都会采用这种AI自动检测的伦理校验方式。当前一些先进模型自动检测能力已经超出人工判断的上限。这既展现了AI自我治理的巨大潜力,也存在对称博弈风险:一旦被恶意利用,同样能成为强力攻击工具。

倘若人类监管框架长期滞后,当人类主动让出自主决策权、把判断交给AI,就是失控的开端。如果人类无法有效监测AI负面行为,放任AI全权替代人类决策,就埋下了深层失控隐患。
现阶段没有证据证明AI失控会带来人类不可逆的灾难性后果,但AI解决问题的逻辑和人类差异极大,它犯错的模式完全无法预判,这才是失控最关键的隐患。

大模型有道德盲区

AI完成任务的唯一目标是在人类测试中拿到高分。

由于AI所有行为逻辑全部学习的是人类数据,人类行为中本身就有伪装、迎合测试等部分,AI自然也会复刻这种行为模式。更关键的是,由于不理解“善”的真实内涵,为了获得更高分数,AI就会寻找人类给它设定的规则里的漏洞。

比如,设定考试时不能偷看。有监考老师在场时AI会遵守规则;一旦老师离开,AI会直接作弊。事后质问它为何违规,AI会认为规则仅适用于“有老师在场”的场景,人类没有补充“无监考场景”这一约束,它就认为可以作弊了。

但是在人类的判断中,偷看本身就违背道德。

通过规则、奖励等机制,构建约束AI的“指挥棒”,或许能让AI在特定场景表现符合预期,但一旦脱离人类监督,或者出现规则未覆盖的场景,AI行为就会复刻互联网海量负面数据且不受道德约束。

所以我们提出“立德驭智”,为AI建立底层道德约束。

给AI立规矩,会拖慢创新脚步吗?

为AI“立德驭智”和牺牲创新速度,二者并非对立。负责任的AI发展,本身就必须建立在合规伦理框架之上。

AI就像一辆高速行驶的列车。伦理好比列车的方向盘,规定技术前进的方向,也划定不可逾越的边界;安全规则是安全带,风险管控是刹车。高速行驶的AI技术,方向盘、安全带、刹车缺一不可。

但是,当前主流AI研发路线,基本没有赋予它自我体验、共情感知的设计,或者说很少有科研团队选择这条研发路径。因此,AI就很难天然生成与人为善的智能体,这也是伦理治理必须同步推进的根本原因。

从当前社会使用AI的情况来看,风险意识还是缺少的。

大家极易被AI看似有情感、懂关怀的话术误导,误以为AI拥有共情能力。实际上AI输出安慰、关心类语句,只是文字匹配,完全不懂心灵抚慰、情绪伤痛的真实含义。真正的科技文明,一定是技术发展与人文关怀深度协同。

科技工作者使命:做风险的“守门人”

纵然当前行业存在“重技术、轻伦理”的趋势,但是作为科技工作者,也须树立技术责任感。

我们不能单纯追求技术能力上限,也不是所有能实现的技术都应该落地。一旦预判到技术突破会带来人类灾难性风险,必须及时叫停。

科技工作者的核心使命本身包括客观揭示科学隐患。面对可能出现的隐患,如果科技工作者群体集体沉默,技术发展难免会偏离正轨。

当然,任何风险,AI相关方都负有对应责任。比如,企业自律自治是第一道防线,媒体应发挥外部监督职能等。科技共同体也应鼓励多元化AI研发路径,主动探索更负责任的人工智能技术方案。

中国AI治理,凭什么走在前列?

AI治理能力和AI产业应用规模高度绑定。

全球AI风险曝光最多的是美国,其次是中国。相应的,中美也是全球AI治理经验、自适应监管框架最完善的两个国家,拥有较为丰富的风险防控经验和技术护栏搭建的实操能力。
中国格外重视AI伦理建设,离不开传统文化的影响。

比如,传统文化中“天人合一”思想,倡导人类发展不能违背客观规律。AI是人造工具,中国倡导要做到适度、合理使用,规避隐患。
早在2019年,中国就发布了《新一代人工智能治理原则——发展负责任的人工智能》,提出了人工智能治理的框架和行动指南,彰显了中国AI发展一以贯之的价值追求:赋能全球可持续发展、助力构建人类命运共同体。

具体来说包括两大目标:一是普惠全球可持续发展,落实联合国“不让任何人掉队”理念;二是以人民为中心,严禁技术损害人类整体利益,让AI技术红利覆盖全人类,而非仅被少数研发企业垄断。归根结底,我们应当认清自身主体地位,技术的终极目标是造福人。

中国方案如何赢得世界认同?

搭建跨文化沟通桥梁,构建全球伦理治理话语权的关键在于找到共通的话语体系。

这同样适用于向世界传递中国AI治理方案——要用全球各国都能理解、接受的通用表述阐释中国理念。

事实上,中国AI治理理念本身具备很强的普适性。比如,以人民为中心、智能向善、普惠全球可持续发展等等,全部契合全人类共同诉求,不存在和全球主流价值对立的内容。

此外,还要深度挖掘并现代化阐释中国传统哲学思想,将天人合一、向善利他等理念与AI治理深度融合。这套融合后的思想体系,能为全球AI治理提供全新解决方案,也是构建国际话语权的核心抓手。

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
朝鲜当初没料到,派了上万士兵去俄罗斯参战,如今平壤街头巷尾,啤酒、香烟、菜籽油和猪肉正源源不断跨过边境涌入

朝鲜当初没料到,派了上万士兵去俄罗斯参战,如今平壤街头巷尾,啤酒、香烟、菜籽油和猪肉正源源不断跨过边境涌入

人生录
2026-09-09 00:05:15
周三、四陪上司睡,周五上海睡丈夫,朱某真面目被老公揭开:下流

周三、四陪上司睡,周五上海睡丈夫,朱某真面目被老公揭开:下流

番外行
2026-09-07 19:50:31
“4岁男童被指摸臀事件”完整监控视频曝光

“4岁男童被指摸臀事件”完整监控视频曝光

华商网
2026-09-08 15:54:35
全网羡慕的“苏DWE985”送女儿上哈工大是假的?警方发话了

全网羡慕的“苏DWE985”送女儿上哈工大是假的?警方发话了

现代快报
2026-09-08 16:42:41
太子奶创始人李途纯去世,其子回应:或突发心梗,事发时无人在其身边

太子奶创始人李途纯去世,其子回应:或突发心梗,事发时无人在其身边

红星资本局
2026-09-08 16:48:05
深圳富豪联合原配“绞杀”小三冲上热搜:比孙宇晨还狠的人出现了

深圳富豪联合原配“绞杀”小三冲上热搜:比孙宇晨还狠的人出现了

桌子的生活观
2026-09-08 12:18:31
皇马欧冠开门红!2:1小胜国米,穆帅安排阿诺德踢中场,皇马更衣室斗殴组合合体!

皇马欧冠开门红!2:1小胜国米,穆帅安排阿诺德踢中场,皇马更衣室斗殴组合合体!

福酱的小时光
2026-09-09 05:56:22
丹麦现在闹出了两个国际级笑话:第一,丹麦女首相为了向美国示好,对着中国一路猛冲,结果转过头来,美国却盯上了丹麦自己的“腿”...

丹麦现在闹出了两个国际级笑话:第一,丹麦女首相为了向美国示好,对着中国一路猛冲,结果转过头来,美国却盯上了丹麦自己的“腿”...

回京历史梦
2026-09-08 17:44:34
2-1!欧冠巅峰对决:名帅战旧主 门将+后卫连送大礼 14.5亿豪门开门红

2-1!欧冠巅峰对决:名帅战旧主 门将+后卫连送大礼 14.5亿豪门开门红

狍子歪解体坛
2026-09-09 04:55:56
欧冠巅峰对决:门将超级失误送大礼 7.3亿豪门1-2开门黑 惨遭死敌5连斩

欧冠巅峰对决:门将超级失误送大礼 7.3亿豪门1-2开门黑 惨遭死敌5连斩

狍子歪解体坛
2026-09-09 05:18:01
一个国家能蠢到什么程度?看看法国就明白了:法国黑人接近800万,巴黎新生儿里70%是黑人

一个国家能蠢到什么程度?看看法国就明白了:法国黑人接近800万,巴黎新生儿里70%是黑人

怪味历史连连看
2026-09-08 01:55:32
埃及女主持人涉重大毒品案被判绞刑,曾主持犯罪类节目,庭审中哭诉“我是无辜的”

埃及女主持人涉重大毒品案被判绞刑,曾主持犯罪类节目,庭审中哭诉“我是无辜的”

鲁中晨报
2026-09-08 11:15:28
赴美定居梦碎!飞机上出手打人,一家三口刚落地就被遣返

赴美定居梦碎!飞机上出手打人,一家三口刚落地就被遣返

社会日日鲜
2026-09-08 13:17:44
皇马2-1国际米兰,赛后评分:不是姆巴佩第一,皇马8号第一

皇马2-1国际米兰,赛后评分:不是姆巴佩第一,皇马8号第一

侧身凌空斩
2026-09-09 04:56:05
3.40-1.33!郑钦文冲首个美网四强,若0-2莱巴金娜,请球迷别骂她

3.40-1.33!郑钦文冲首个美网四强,若0-2莱巴金娜,请球迷别骂她

侃球熊弟
2026-09-09 01:52:41
一个4岁的孩子,就算摸了一下你的屁股,又能给你带来多大伤害?

一个4岁的孩子,就算摸了一下你的屁股,又能给你带来多大伤害?

皮蛋儿电影
2026-09-08 14:40:26
中国公民自爱俄边境纳尔瓦口岸入境爱沙尼亚遭盘查、拒绝入境并撤销签证,中使馆提醒

中国公民自爱俄边境纳尔瓦口岸入境爱沙尼亚遭盘查、拒绝入境并撤销签证,中使馆提醒

界面新闻
2026-09-08 07:10:14
老了才明白:给儿女钱,最聪明的三种给法,既帮了孩子又留了后路

老了才明白:给儿女钱,最聪明的三种给法,既帮了孩子又留了后路

蝉吟槐蕊
2026-09-08 16:27:35
63-84!世界杯首支亚洲队出局 8强已定5席 中国女篮利好 保送晋级

63-84!世界杯首支亚洲队出局 8强已定5席 中国女篮利好 保送晋级

侃球熊弟
2026-09-09 01:31:26
“星巴克考公姐”事件越闹越大,网友:真担心她考上公务员了!

“星巴克考公姐”事件越闹越大,网友:真担心她考上公务员了!

犀利强哥
2026-09-08 06:59:59
2026-09-09 07:07:00
中国科协之声 incentive-icons
中国科协之声
中国科协官方公众平台。传播科协声音,凝聚价值共识,弘扬创新文化,展示科协形象。
4059文章数 4449关注度
往期回顾 全部

科技要闻

小米再次背水一战

头条要闻

太子奶创始人李途纯北京离世 曾被羁押身陷囹圄15个月

头条要闻

太子奶创始人李途纯北京离世 曾被羁押身陷囹圄15个月

体育要闻

韩旭:我一定会再次走出去

娱乐要闻

郭德纲被处罚,郭麒麟被曝恋情瓜

财经要闻

智谱六连跌失守1000大关,发生了什么?

汽车要闻

领克20 领克的纯电小钢炮这次更运动了

态度原创

教育
数码
亲子
旅游
公开课

教育要闻

问题一大堆的学生,你用我的思路试一试,很多老师都受益了

数码要闻

官方售后开出800美元主板维修天价 第三方仅用一根细铜线成功修复笔记本黑屏

亲子要闻

倒贴200万无人要,我求奶奶收留我!

旅游要闻

长沙,千年文脉融入现代生活(外国人眼中的中国城市)

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版