原创 李飞飞叫板梁文锋?几百元不到半小时蒸馏出AI模型
创始人
2025-02-08 21:17:23
0

最近梁文锋的DeepSeek很火,震惊了华尔街。那么,问题来了,既然DeepSeek是蒸馏出来的大模型,其他人会不会效仿这种方法。第一个叫板DeepSeek的是华裔李飞飞,据透露,她仅用50美元,短时间就蒸馏出类似DeepSeek-R1的推理模型S1,该模型在数学及编码能力方面,与OpenAI O1和DeepSeek R1几乎处于同一水平。

参与研制S1模型的,是李飞飞团队(包括斯坦福大学及华盛顿大学的研究人员)等,花费50美元,折合人民币大约360元。当然,这只是部分成本(云计算费用)。该团队使用了16个英伟达H100 GPU,用时26分钟完成了训练过程‌。

当然,李飞飞团队的S1模型,同样是站在前人肩膀上的,秘诀同样是蒸馏。其以阿里通义团队的Qwen2.5- 32B-Instruct作为基础模型,并通过蒸馏谷歌DeepMind的推理模型Gemini 2.0 Flash Thinking实验版,最终蒸馏出S1模型。目前,该模型已宣布开源,李飞飞研究团队公布了训练数据及代码。

李飞飞何许人也?她1976年出生于北京,有“AI教母”之称。据公开信息,她16岁随家人移民美国新泽西。她是人工智能方面的专家,美国斯坦福大学首位红杉讲席教授,长期研究人工智能。2013年至2018年,她担任斯坦福人工智能实验室主任,她还曾担任过Google副总裁以及Google Cloud AI/ML首席科学家。

李飞飞集多重荣耀于一身,是美国国家工程院院士、美国国家医学院院士、美国艺术与科学院院士。李飞飞的研究领域主要包括计算机视觉、认知神经科学、计算神经科学和大数据分析。

美国工程院对李飞飞的评价是:她为建立大型机器学习和视觉理解知识库做出了贡献。斯坦福大学对李飞飞给出了高度评价,认为她是ImageNet和ImageNet Challenge的发明者,为深度学习和AI的最新发展做出了贡献。并且,斯坦福大学还称赞她,除了技术贡献外,还是倡导STEM及AI多样性的全国领导者。

相关内容

印度将为美国生产所有iPh...
【太平洋科技快讯】8 月 19 日,据彭博社报道,苹果公司正大幅提...
2025-08-21 11:48:05
字节突然开源Seed-OS...
梦晨 发自 凹非寺 量子位 | 公众号 QbitAI 字节跳动突发...
2025-08-21 11:15:39
AI学什么(第15期):开...
大家好,我是蓝衣剑客,欢迎来到「AI学什么」——一个专注于AI科普...
2025-08-20 21:43:32
原创 ...
据新华社消息,最近国际上的事儿可真不少,尤其是普特会之后,各方动静...
2025-08-20 18:13:57
原创 ...
近期,七艘中国民用滚装船组成船队,悄然南下东海。这一行动让美方如坐...
2025-08-20 16:13:12
特朗普缓禁TikTok,字...
去年,美国多数议员以中国科技巨头字节跳动威胁国家安全为由,推动立法...
2025-08-20 15:45:37

热门资讯

原创 2... #春日生活好物种草季#近年来,笔记本电脑市场迎来技术爆发期,尤其在手机厂商跨界入局后,轻薄本在性能、...
AMD锐龙AI 9 HX 37... 2024年6月3日,AMD正式发布全新的锐龙AI 300系列处理器。该系列处理器一经发布就引发大家的...
骁龙本这么猛?联想YOGA A... 在人人都是自媒体的时代,一部手机可以解决出镜拍摄问题,而商务出差、大量码字、图像处理等需求用笔记本则...
5个AI模特生成软件推荐 当前AI模特生成软件市场提供了多样化的解决方案,以下是几款备受推崇的工具: 触站AI:强烈推荐!...
2023年CentOS与Ubu... CentOS与Ubuntu的市场格局与技术特性探讨 在服务器操作系统领域,CentOS与Ubuntu...
苹果macOS 15.1:允许... 苹果公司在其最新的macOS 15.1版本中,推出了一项引人注目的新功能——允许用户将Mac App...
原创 苹... 前言 IQUNIX在做好看的桌面产品上,一直都给我留下非常深刻的印象。而且早期和苹果产品的设计风格...
原创 华... 想在竞争残酷的市场中发力,必须要带来一些激进的卖点,但是随着功能特性的提升,硬件也必须要进行给力才可...
原创 华... 在2024年这个被誉为"AI元年"的关键时刻,随着生成式AI的流行,各家手机厂商都在积极备战AI手机...