直接的例子就是MoE(混合专家模型)上的“豪赌”。
时间回到2023年夏天,国内的大模型厂商们纷纷加快了研发进度,摆在MiniMax面前的现实问题是:自家2B和2C的产品已经有很多用户,传统dense(稠密)模型生成token的成本太高,延时太严重;在计算资源有限的情况下,只有MoE才能训练完当时的数据。
理论上讲,MoE相较于dense模型的预训练速度更快,在相同参数的情况下,有着更快的推理速度,但在微调方面存在诸多挑战,比如泛化能力不足容易引发过拟合现象,属于典型的“技术派才有的红利”。
其他厂商选择dense模型快速迭代的时候,MiniMax放了80%以上的算力和研发资源做MoE,而且没有Plan B。
拐点出现在2024年初,MiniMax发布了国内首个基于MoE架构的abab 6,找到了越来越多加速实现Scaling Laws的途径,包括改进模型架构、重构数据pipeline等等,并在三个月后研发出了更强大的abab 6.5。
正如外界所熟知的,长文本能力在2024年成为生产力工具的“胜负手”,万亿参数的abab 6.5已经200k tokens 的上下文长度,综合能力已经不逊于国外主流大模型;使用同样的训练技术和数据的abab 6.5s,进一步提升了推理速度,可以在1秒内处理近3万字的文本。
按照业界常用的“大海捞针”机制,即在很长的文本中放入一个和该文本无关的句子(针),然后通过自然语言提问模型,看模型是否准确将这个针回答出来。在891次问答中,abab 6.5均能正确回答。
现在,MoE模型已经上升为行业共识,被认为是高性能AI大模型的必选项,而MiniMax已经在这条路上“抢跑”了一年。
02 技术驱动的产品方法论
让许多人没想到的是,一群痴迷于技术的工程师,“意外”做出了多个日活用户超过100万的产品,包括Glow、星野、海螺AI等,涵盖内容社区、生产力工具等不同方向。
曾有媒体在采访时询问闫俊杰:“你们第一个模型还没做出来,就招了产品经理,当时你如何向他描述你想要一个怎样的产品?”出乎预料的是,闫俊杰给出的回答只要三个字:“不知道。”
闫俊杰口中的“不知道”,源于对技术的敬畏:当前AI原生的超级产品,无不源自突破性的技术进步。
比如搜索问答几乎是所有对话式AI的标配,也是我们使用生产力工具提升工作效率的刚需功能。但越是基础的功能,越能验证生产力工具的价值,考验背后大模型的能力。
百度发布2024年Q1财报后,我们同时在海螺AI和国外的一款产品进行了对比,用户体验可谓高下立见:
我们的问题是皮尔斯·布朗的代表作《火星崛起》,曾被《娱乐周刊》评为2014年度最佳图书,但知名度不如《火星救援》、《星球崛起》等可能被AI混淆的名著。海螺AI准确理解了我们的需求,生成的故事梗概可圈可点,并给出了深刻的评价;豆包将我们的需求误解为《星球崛起》,生成的内容居然是《火星三部曲》的介绍。
技术的上限左右着产品的上限。
MiniMax之所以做出了海螺AI这样“能打”的生产力工具,根源在于技术驱动的产品方法论,只有具备足够好的产品能力,才能承接和转化取得的技术进展,否则会落得一场空。
当然,MiniMax也有自己的“野心”。就像闫俊杰所筹划的:“在技术快速进化的窗口关闭前,做出用户量巨大的To C产品。”
03 做普通人每天用的产品
资本圈里流传着一句话:判断一位人工智能创业者是否真正的AGI信仰,就看这个人创业是在2023年之前还是之后。作为普通用户,则有另一套判断标准,即能不能解决实际问题,扎扎实实地提高工作效率。
行事低调的闫俊杰,很少围绕AGI的话题高谈阔论,但在媒体采访时讲述了自己朴素的信仰:Intelligence with everyone。
怎么理解“与用户共创智能”?海螺AI无疑是最直观的研究对象。
生产力工具作为当下最拥挤的大模型赛道,市面上的产品已经多达几十款,豆包、文心一言、智谱清言、Kimi……哪怕是在高度内卷的局面下,肩负MiniMax信仰的海螺AI,依然表现出了差异化和稀缺性。
首先是简洁的产品设计。
为了争夺用户的注意力和时长,越来越多的对话式AI产品在首页上添加了丰富的菜单栏,努力向用户表达功能的多样性。海螺AI不可谓不克制,首页上除了简单的功能引导和对话框外,并没有其他影响注意力的元素。
而产品能力的强弱,往往体现在一些细节中。以我们高频使用的长文总结为例,将第三方行业报告上传到海螺AI,可以准确梳理报告的核心信息,并根据报告内容进行对话。原先阅读一篇报告需要至少两个小时的时间,现在不到5分钟就能完成,工作效率可以说是实现了指数级增长。
然后是多元的使用场景。
有些产品尽可能在首页上推荐足够多的“角色”,来告诉我们有很多使用场景,适合不同的用户。仅仅在prompt下功夫,当真可以满足不同人群的需求吗?市场初期也许奏效,可终归不是解决问题的最优解。
海螺AI的答案是从能力上满足不同人群的需求:帮研究人员快速总结和分析长篇学术论文或研究报告、帮内容创作者整合关键信息并生成爆款文章、帮知识工作者整理和回顾学习资料、为日常用户提供生活中的即时帮助……就像是一个能打的六边形战士,背后是万亿参数MOE大模型的底气。
一言以蔽之,只有做出足够产品化、能服务大众的AI技术和产品,才可以给社会带来足够高的反馈。在MiniMax的认知里,AGI不是原子弹那样的大杀器,而是普通人每天会用的产品和服务。
04 写在最后
每一次代际演变的出现,都会经历百花齐放到超级APP“统治”市场的过程。
大模型的产品化也不例外。现阶段AI产品的核心价值,主要来自模型性能和算法能力,不排除会上演“赢者通吃”的一幕。特别是对于寻求生产力的用户,拥抱海螺AI这样的超级APP,卸载掉“尝鲜”时下载的几十个APP,将是可以预见的结果。
版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至253000106@qq.com举报,一经查实,本站将立刻删除。
发布者:SEO优化专员,转转请注明出处:https://www.chuangxiangniao.com/p/962794.html