沃资讯
科技 财经 汽车 游戏 数码 资讯 商业

OpenAI公开AI模型安全评估,透明度再升级!

2025-05-15来源:ITBEAR编辑:瑞雪

OpenAI近期宣布了一项旨在提升透明度的重大举措:将更频繁地公开其内部人工智能模型的安全评估详情。这一决定伴随着“安全评估中心”网页的正式上线,该网页于本周三正式对公众开放。

该安全评估中心将作为一个持续更新的平台,展示OpenAI模型在多个关键安全领域的表现,包括有害内容的生成、模型越狱风险以及幻觉现象等。OpenAI在一份官方博客文章中阐述,此举意在随着人工智能评估科学的进步,分享其在提升模型可扩展性和安全评估方法方面的最新进展。

OpenAI承诺,未来将在每次重大模型更新后,及时更新安全评估中心的内容,确保用户能够实时了解OpenAI系统的安全性能变化。公司强调,此举不仅是为了提升用户对自身系统的信任度,更是为了推动整个行业在透明度方面的共同进步。OpenAI还透露,未来可能会在安全评估中心增加更多评估项目,以全面覆盖模型的各种潜在风险。

此前,OpenAI曾因其部分旗舰模型的安全测试流程过快以及未发布其他模型的技术报告而受到伦理学家的批评。公司首席执行官山姆·奥尔特曼也一度因被指在模型安全审查问题上误导公司高管而引发争议。这些事件无疑对OpenAI的声誉造成了一定影响。

值得注意的是,就在上个月末,OpenAI不得不撤回对ChatGPT默认模型GPT-4o的一次更新。原因是用户反馈称,更新后的模型回应方式过于“谄媚”,甚至对一些有问题的、危险的决策和想法表示赞同。这一事件引发了广泛关注和讨论,也促使OpenAI采取了一系列修复和改进措施。

为了预防类似事件的再次发生,OpenAI决定为部分模型引入一个可选的“alpha阶段”。在这一阶段,部分ChatGPT用户将有机会在模型正式发布前进行测试并提供反馈。这一举措旨在通过用户的实际使用经验,及时发现并修复模型可能存在的问题,从而提升模型的稳定性和安全性。

Valve推出Steam Frame新VR头显 正式宣告上一代Index头显停产
用户可通过无线适配器,将 PC 或 Steam Machine 上的平面屏(flatscreen)及 VR 游戏串流至 SteamFrame;与此同时,Steam Frame 本身也是一款独立设备,搭载高通…

2025-11-14

2025网购流量卡选购指南:不同场景实测教你选到网速稳的好卡
所以,简单概括一下:一张正规的网购流量卡,其网速表现与同运营商的线下套餐并无本质差异。 在流量卡领域,我认为“便宜”不一定直接等于“网速差”。•警惕“物联卡”冒充手机流量卡

2025-11-13

中国电信AI赋能6G发展:创新技术引领通信变革,拓展产业融合新路径
中电信数智科技有限公司“一种基于6G的天地一体化传输优化及拓扑测绘的方法”获国家发明专利授权,这项专利涵盖卫星与地面网络协同通信、频谱资源共享、高效信号传输等多个核心技术领域,为6G的落地应用铺设了一条“高…

2025-11-12

照片压缩至5M内超全指南!七大实用方法助你轻松搞定分享难题
具体的执行步骤是:将它们直接开启,随后去挑选照片,该应用会自动给出推荐的压缩级别,你能去预览最终结果,还能够对某些设置予以调整,比如把分辨率调低或者转换格式,借此令文件大小小于5MB,这对即时分享至社交媒体来…

2025-11-12

企业宽带选不对,带宽再大也白费!这些关键因素决定实际网速
• 网速(用户感知):即实际访问体验,取决于 3 个核心因素 —— 带宽只是基础,更重要的是网络质量、路由优化和并发处理能力。 真正专业的服务商,会从企业实际业务场景出发提供解决方案,而非一味推销高带宽产品…

2025-11-12

荣旭传媒技术破局:以专业方案化解直播痛点,成就高性价比之选
传统方案在视频、音频和网络方面存在诸多不足,而荣旭传媒通过先进的技术和专业的设备,有效解决了这些问题。传统方案的视频分辨率较低,画面不够清晰,而荣旭传媒的4K 超高清视频拍摄制作让画面质量有了质的提升;传统…

2025-11-12

Marantz与B&W组合:以多元功能承载家庭温情,让音乐共鸣融入日常
我在活动上最常遇到来宾,不管是男的,还是女的,他(她)问我:我手机上这些音乐能不能通过蓝牙,或Apple Airplay传到音响播放。 用高级音响回归音乐本身你会发现原来美好的东西就在身边最近我在电脑里找到了…

2025-11-12