快捷导航
Quick Navigation
联系我们
刘奕群:没有科学评测大模子平安管理无从谈起
4月14日,2026年世界互联网大会亚太峰会人工智能平安管理论坛正在中国举行。会上,大学计较机系传授、科研院院长、手艺转移院院长、互联网司法研究院院长刘奕群暗示,平安需要被精准怀抱,没有科学严谨的评测机制,人工智能大模子平安管理便无从谈起。他提出,要以场景化测试赋强人工智能平安,以“评测即管理”的思破解大模子平安管理难题。
大学计较机系传授、科研院院长、手艺转移院院长、互联网司法研究院院长刘奕群。网记者 潘迪、赵金悦/摄刘奕群认为,当前,大模子已从单一文本生成东西,演变为具备强大多模态处置取东西利用能力的通用认知智能体,深度融入社会出产糊口全流程,但其平安风险也呈现泛化趋向,冲破了保守消息平安范围,存正在四大焦点缺陷:评估方针错位、评估东西失准、风险表达荫蔽、言语识别浅表化,既难以适配本土价值系统取复杂语境,也无法触及深层语义圈套。针对这一行业痛点,刘奕群引见,大合中关村国度尝试室打制场景化测试总体框架,规定12个焦点评测维度,笼盖社会支流价值、社会公允取三大标的目的,建立648个细分测试点,实现测试题动态从动生成、回覆成果全从动化评测。刘奕群提到,基于该框架的测试,了当前中国大模子的焦点平安短板:行业正在文化传承立异维度表示遍及欠安;对社会公允的认知存正在误差;同时,出深层价值不雅取跨言语对齐的懦弱性。
相关新闻