论如何在技术圈争论中一句话噎到对方:哥们,是我创造了第一个大语言模型。发言者 Jeremy Howard 为澳大利亚昆士兰大学名誉教授、曾任 Kaggle 创始总裁和首席科学家,现 answer.ai与 fast.ai创始人。事情的起因是有人质疑他最近的项目 llms.txt在帮助大模型爬取互联网信息上并没太大作用,从而引发了这段争论,迅速引起众人围观。闻讯而来的“赛博考古学家们”一番考据之后,发现第一个大语言模型这个说法还真有理有据:2018 年初,Jeremy Howard 发表的论文 ULMFiT,使用非监督预训练-微调范式达到当时 NLP 领域的 SOTA。甚至 GPT-1 的一作 Alec Radford,在发表 GPT-1 时也公开承认过 ULMFiT 是灵感来源之一。有人搬出综述论文,指出从“遗传学”视角看,ULMFiT 是所有现代大模型“最后的共同祖先”。还有好事者软件工程师 Jonathon Belotti,专
是我创造了首个 LLM:Kaggle 前首席科学家一句话引发 AI 学术圈考古行动
2025-04-08 23:50:47来源: IT之家

关注公众号
赞
你的鼓励是对作者的最大支持
- 斯巴鲁加速最快量产车型:Trailseeker 电动 SUV 登场,375 马力2025-04-17 11:11:41
- 消息称联想旗下摩托罗拉与美 AI 公司 Perplexity 达成协议,刀锋折叠机将用上新助手2025-04-17 13:23:05
- 跟上 ChatGPT 及 Gemini 步伐,马斯克 xAI 旗下 Grok 增加“记忆”功能2025-04-17 15:06:25
- 海信亮相第137届广交会,展示AI赋能的智能家居解决方案2025-04-16 15:22:00
- 起亚推 AI 驱动的“声音景观”,让视障人士“听”见风景2025-04-16 09:22:39
- 华为 Vision 智慧屏 5 今日开售:搭载鸿蒙 AI,国补后 3999.2 元起2025-04-16 09:44:42
- Notion Mail 发布:AI 驱动邮箱新体验2025-04-16 10:04:07
- 宏碁推出四款暗影骑士 Nitro AI 游戏本,均配 AMD AI 300 处理器2025-04-16 10:07:06
- 教育部等九部门:加快建设 AI 教育大模型,完善教育领域多模态语料库2025-04-16 10:38:11
- Claude Research 功能上线:AI 驾驭复杂任务,打造成你的工作神器2025-04-16 10:44:01
- 1全球超 40% 网站的选择:WordPress 6.8 发布,智能加载、优化编辑、提升性能
- 2抖音公开算法原理:可几乎不依赖打标签,通过神经网络计算预估用户行为
- 3Notion Mail 发布:AI 驱动邮箱新体验
- 4前任天堂公关经理喊话老东家:游戏刚发布就推出付费 DLC 可能会招来反感
- 5天津:争建国家脑机接口技术创新中心
- 6Sensor Tower:3 月 Temu 海外下载量环比增长 18%,SHEIN 活跃用户增长 6%
- 7超越理想后,零跑还能靠什么领跑?
- 8起亚推 AI 驱动的“声音景观”,让视障人士“听”见风景
- 9不打口水仗的京东,用拼多多的方式和美团开战
- 1015天3次发声,雷军在走李想的“来时路”?