沃资讯
科技 财经 汽车 游戏 数码 资讯 商业

低成本高效能!斯坦福团队打造媲美OpenAI推理模型s1

2025-02-06来源:ITBEAR编辑:瑞雪

近期,人工智能领域迎来了一项引人注目的新突破。据一份最新发布的研究报告显示,斯坦福大学与华盛顿大学的科研团队,仅凭不到50美元的云计算成本(当前汇率下约364元人民币),就成功打造了一款具备卓越“推理”能力的人工智能模型——s1。

这款s1模型在数学与编程能力测试中,展现出了与OpenAI的o1、DeepSeek的r1等业界顶尖推理模型相媲美的水平。更令人瞩目的是,s1模型及其训练数据和代码已在GitHub平台上全面开源,供全球开发者研究和使用。

s1团队揭秘,他们采用了“蒸馏”技术来创建这款模型。该技术通过训练模型来学习另一个AI模型的答案,从而提炼出其核心推理能力。据悉,s1模型是从谷歌的Gemini 2.0 Flash Thinking Experimental模型中蒸馏而来。而就在上个月,加州大学伯克利分校的研究人员也运用相同的蒸馏方法,以约450美元的成本开发了一款AI推理模型。

随着s1等类似模型的出现,人工智能领域的商品化问题日益凸显。当有人能够以极低的成本复制出价值数百万美元的模型时,大型科技公司的竞争优势何在?这一问题引发了业界的广泛关注和讨论。

面对这一挑战,大型AI实验室纷纷表达不满。例如,OpenAI就曾指责DeepSeek不当获取其API数据用于模型蒸馏。而s1团队则致力于探索实现强大推理性能和“测试时扩展”的最简洁途径,这些正是OpenAI的o1模型所取得的突破。

s1的论文指出,通过监督微调(SFT)方法,可以使用较小的数据集来蒸馏推理模型。在SFT过程中,AI模型被明确指示在数据集中模仿特定行为。相较于DeepSeek用于训练R1模型的大规模强化学习方法,SFT更具成本效益。

值得注意的是,谷歌通过其Google AI Studio平台免费提供Gemini 2.0 Flash Thinking Experimental模型的访问权限,但设有每日使用限制。然而,其使用条款明确禁止对模型进行逆向工程,以开发与谷歌自身AI产品竞争的服务。尽管如此,s1团队还是巧妙地利用了这一资源。

s1模型基于阿里巴巴旗下中国人工智能实验室Qwen提供的一款小型、现成的免费AI模型。为了训练s1,研究人员精心策划了一个包含1000个问题及其答案的数据集,并收集了谷歌Gemini 2.0 Flash Thinking Experimental对每个答案背后“思考”过程的输出。

在训练过程中,研究人员使用了16个Nvidia H100 GPU,耗时不到30分钟,便成功训练出了s1模型。据参与该项目的斯坦福大学研究员Niklas Muennighoff透露,目前租用这些计算资源的成本约为20美元。这一低廉的成本再次凸显了s1模型的性价比优势。

为了进一步提升s1的性能,研究人员还采用了一个巧妙的技巧:让s1在推理过程中“等待”。论文显示,在s1的推理步骤中添加“等待”一词,有助于模型获得更为准确的答案。这一发现为AI模型的优化提供了新的思路。

Valve推出Steam Frame新VR头显 正式宣告上一代Index头显停产
用户可通过无线适配器,将 PC 或 Steam Machine 上的平面屏(flatscreen)及 VR 游戏串流至 SteamFrame;与此同时,Steam Frame 本身也是一款独立设备,搭载高通…

2025-11-14

2025网购流量卡选购指南:不同场景实测教你选到网速稳的好卡
所以,简单概括一下:一张正规的网购流量卡,其网速表现与同运营商的线下套餐并无本质差异。 在流量卡领域,我认为“便宜”不一定直接等于“网速差”。•警惕“物联卡”冒充手机流量卡

2025-11-13

中国电信AI赋能6G发展:创新技术引领通信变革,拓展产业融合新路径
中电信数智科技有限公司“一种基于6G的天地一体化传输优化及拓扑测绘的方法”获国家发明专利授权,这项专利涵盖卫星与地面网络协同通信、频谱资源共享、高效信号传输等多个核心技术领域,为6G的落地应用铺设了一条“高…

2025-11-12

照片压缩至5M内超全指南!七大实用方法助你轻松搞定分享难题
具体的执行步骤是:将它们直接开启,随后去挑选照片,该应用会自动给出推荐的压缩级别,你能去预览最终结果,还能够对某些设置予以调整,比如把分辨率调低或者转换格式,借此令文件大小小于5MB,这对即时分享至社交媒体来…

2025-11-12

企业宽带选不对,带宽再大也白费!这些关键因素决定实际网速
• 网速(用户感知):即实际访问体验,取决于 3 个核心因素 —— 带宽只是基础,更重要的是网络质量、路由优化和并发处理能力。 真正专业的服务商,会从企业实际业务场景出发提供解决方案,而非一味推销高带宽产品…

2025-11-12

荣旭传媒技术破局:以专业方案化解直播痛点,成就高性价比之选
传统方案在视频、音频和网络方面存在诸多不足,而荣旭传媒通过先进的技术和专业的设备,有效解决了这些问题。传统方案的视频分辨率较低,画面不够清晰,而荣旭传媒的4K 超高清视频拍摄制作让画面质量有了质的提升;传统…

2025-11-12

Marantz与B&W组合:以多元功能承载家庭温情,让音乐共鸣融入日常
我在活动上最常遇到来宾,不管是男的,还是女的,他(她)问我:我手机上这些音乐能不能通过蓝牙,或Apple Airplay传到音响播放。 用高级音响回归音乐本身你会发现原来美好的东西就在身边最近我在电脑里找到了…

2025-11-12