注册
登录
专栏名称:
Datawhale
一个专注于AI领域的开源组织,汇聚了众多顶尖院校和知名企业的优秀学习者,聚集了一群有开源精神和探索精神的团队成员。愿景-for the learner,和学习者一起成长。
我也要提交微信公众号
今天看啥
微信公众号rss订阅, 微信rss, 稳定的RSS源
微信公众号RSS订阅方法
B站投稿RSS订阅方法
雪球动态RSS订阅方法
微博RSS订阅方法
微博搜索关键词订阅方法
豆瓣日记 RSS订阅方法
目录
相关文章推荐
青岛新闻网
·
一地明确:生三孩奖3万
·
3 天前
今天看啥
›
专栏
›
Datawhale
原来,这些顶级大模型都是蒸馏的!
Datawhale
·
公众号
· · 2025-01-31 22:09
文章预览
Datawhale干货 大模型:蒸馏,整理:机器之心 「除了 Claude、豆包和 Gemini 之外,知名的闭源和开源 LLM 通常表现出很高的蒸馏度。」这是中国科学院深圳先进技术研究院、北大、零一万物等机构的研究者在一篇新论文中得出的结论。 前段时间,一位海外技术分析师在一篇博客中提出了一个猜想:一些顶级的 AI 科技公司可能已经构建出了非常智能的模型,比如 OpenAI 可能构建出了 GPT-5,Claude 构建出了 Opus 3.5。但由于运营成本太高等原因,他们将其应用在了内部,通过蒸馏等方法来改进小模型的能力,然后依靠这些小模型来盈利。 当然,这只是他的个人猜测。不过,从新论文的结论来看,「蒸馏」在顶级模型中的应用范围确实比我们想象中要广。 具体来说,研究者测试了 Claude、豆包、Gemini、llama 3.1、Phi 4、DPSK-V3、Qwen-Max、GLM4-Plus 等多个模型,发现 ………………………………
原文地址:
访问原文地址
快照地址:
访问文章快照
总结与预览地址:
访问总结与预览
分享到微博
推荐文章
青岛新闻网
·
一地明确:生三孩奖3万
3 天前
最搞笑笑话王
·
女婿找丈母娘退货,赌你会笑抽!
7 月前
盘前消息
·
不良资产.金融补涨相关概念股梳理
4 月前
瑞达利欧
·
每日原则:你很可能没有时间处理不重要的事,但这比没有时间处理重要的事要好得多
3 月前
北京时间
·
演员杨洋案,判了!
1 月前
CLECSS
·
【CLECSS 3881】本周香港IPO哪些律所参与 + 评论
1 月前