环球观焦点：清华大学黄民烈团队：发布安全评估框架促大模型迈向可控可信-热讯印刷网

(相关资料图)

中新网北京3月27日电 (贾君玉张素)记者近日采访清华大学计算机科学与技术系长聘副教授黄民烈获悉，历时两年多时间，由他带领的科研团队建立了大模型安全分类体系，并从系统层面和模型层面等打造了大模型安全框架。

近年来，随着技术突破，大模型获得快速发展并在多个场景得到应用。不过，其存在的事实性错误、知识盲区等问题，以及面临的训练数据来源合规性、生成内容安全性等风险，也已受到广泛关注。

在黄民烈看来，要规避安全风险，降低人工智能对人类的负面影响，关键在于大模型底座。“大规模语言模型(LLM)发展到现在，模型结构和规模已有很大进展，但实用性还有待加强，我们应该通过技术让模型更加安全、可控，使其快速适配更多的应用场景。”他说。

此次，聆心智能联合清华大学CoAI实验室共同发布大模型安全评估框架。作为聆心智能的创始人，黄民烈介绍说，他们希望通过对大模型应用边界进行定义，促进大模型生态健康发展，推动人工智能研究和应用向更有用、更可信、更安全迈进。

据知，黄民烈团队建立的大模型安全分类体系中设定的不安全对话场景，包括犯罪违法、身体健康、心理健康、财产隐私、歧视/偏见、辱骂/仇恨言论等方面。科研人员针对这些安全场景对大模型进行升级，使之具备基本的安全性，“能够在遇到安全问题时给予正确的回复策略，不进行判断误导”。

此外，着眼于容易触发的安全问题类型，科研团队还总结、设计出一般模型难以处理的“安全攻击方式”，使安全体系更加完善。

黄民烈表示，未来，他们将打造中文大模型的安全风险评估的Leaderboard，为国内对话大模型的安全评估提供公平公开的测试平台，并提供针对中文对话的安全场景等，“依托自身核心技术，在可控可信的超拟人大模型基础之上，通过建立安全、可控的模型边界，让人工智能提供可信、可靠的输出”。(完)

关键词：

推荐阅读

环球观焦点：清华大学黄民烈团队：发布安全评估框架促大模型迈向可控可信

推荐阅读

环球观焦点：清华大学黄民烈团队：发布安全评估框架促大模型迈向可控可信

从传记和戏剧，解读作为“现代人”的卡夫卡|精彩看点

适合家里养的多肉有哪些？

广阳区：建设“小市场” 保障“大民生”_环球头条

连锁店包子里发现生锈注射针头？“大概有一指节长”

沪深股通|泽宇智能3月30日获外资卖出0.03%股份_速递

全球视点！南京南站到禄口机场要多久（南京南站到禄口机场）

关于填报2022年度高新技术企业年度发展情况报表的通知

3月，终于等来这样一部“良心”国产片，电影的结尾，太惊艳了每日时讯

市州观察丨乐山首个东西部协作名校长工作室挂牌

新生儿哭闹的原因和安抚的方法刚出生的婴儿老是哭闹是什么原因

伽马数据：2022年中国自主研发网络游戏市场实际销售收入为2223.77亿元同比下降13.07%

长沙粟塘小区公租房可以出租吗？

【发现春之美】萌翻了！喜看神州大地小动物“闹”春图-焦点热讯

Win11系统自带输入法怎么卸载？Win11自带输入法删除方法教学

家纺品牌排行榜(十大家纺排名是什么呢)

抖音来客怎么修改抖音名字操作方法介绍_环球观察

大商所开展做市商常态化遴选工作

行尸走肉般活着，痛苦难堪似的伤害别人焦点资讯

快速增长态势下，清洁能源如何实现高质量发展？_新动态

如何重装ie_重装ie的方法

全球消息！真银矿石在哪里采_真银矿石

每日资讯：构筑礼宾出行服务生态圈耀出行引领中国高品质出行品牌再升级

堃博医疗-B(2216.HK)：呼吸介入治疗产品进度遥遥领先，创新赋能长期发展 _世界短讯

当前关注：首批两只新能源基础设施公募REITs在上交所上市

《五星出东方》将在和田驻场演出环球快播报

世界观点：万家万好(200008基金净值查询)

环球今日讯！清明假期，广州地铁5条线路5日当天延长运营1小时

世界动态:赵露思的春日写真，一袭晕染青色纱裙，柔美灵动甜笑可人

全球焦点！一线调研丨助力中小企业爬坡过坎成长壮大

资讯

头条

快讯

热点

设备

纸箱

环球观焦点：清华大学黄民烈团队：发布安全评估框架 促大模型迈向可控可信

推荐阅读

资讯

头条

快讯

热点

设备

纸箱

环球观焦点：清华大学黄民烈团队：发布安全评估框架促大模型迈向可控可信