谁需要大型AI模型?

1个月前 科技 9观看
摘要 AI领域持续快速发展,特别是自DeepSeek及其追随者推出以来。许多人得出结论,企业并不真正需要OpenAI、Meta和谷歌推广的大型昂贵AI模型,而是专注于更小的模型,如拥有24亿参数的DeepSeek V2-Lite,或

AI领域持续快速发展,特别是自DeepSeek及其追随者推出以来。许多人得出结论,企业并不真正需要OpenAI、Meta和谷歌推广的大型昂贵AI模型,而是专注于更小的模型,如拥有24亿参数的DeepSeek V2-Lite,或拥有170亿参数的Llama 4 Scout和Maverick,这些模型能够以更低的成本提供不错的准确性。然而,对于程序员来说情况并非如此,或者更准确地说,对于那些能够并将会取代许多程序员的模型来说并非如此。"越小越好"的理念也不适用于推理或智能体AI——下一个重大发展方向。Po1喜好网-记录每日喜好的科技时尚娱乐生活

AI代码生成器需要能够处理更大上下文窗口的大型模型,能够容纳大约10万行代码。支持智能体和推理AI的专家混合(MOE)模型也很庞大。但这些大型模型通常相当昂贵,在现代GPU上每百万输出Token的成本约为10到15美元。这为新型AI架构侵蚀GPU领域提供了机会。Po1喜好网-记录每日喜好的科技时尚娱乐生活

Cerebras Systems推出搭载Qwen3-235B的大型AIPo1喜好网-记录每日喜好的科技时尚娱乐生活

Cerebras Systems(寒武纪AI研究的客户)宣布支持大型Qwen3-235B,支持131K上下文长度(约200-300页文本),是之前可用长度的四倍。在巴黎的RAISE峰会上,Cerebras推广了阿里巴巴的Qwen3-235B,该模型使用高效的专家混合架构来提供出色的计算效率。但真正的新闻是,Cerebras能够以每百万输入Token和每百万输出Token仅0.60美元的价格运行该模型——不到同类闭源模型成本的十分之一。虽然许多人认为Cerebras晶圆级引擎价格昂贵,但这一数据颠覆了这种看法。Po1喜好网-记录每日喜好的科技时尚娱乐生活

我经常被问到的一个问题是,如果Cerebras如此快速,为什么他们没有更多客户?一个原因是他们之前不支持大上下文窗口和更大的模型。例如,那些寻求开发代码的人不想将问题分解成更小的片段来适应32KB的上下文。现在,这个销售障碍已经消失。Po1喜好网-记录每日喜好的科技时尚娱乐生活

"我们看到开发者对具有长上下文的前沿模型有巨大需求,特别是用于代码生成,"Cerebras Systems首席执行官兼创始人Andrew Feldman说。"Cerebras上的Qwen3-235B是我们第一个能与Claude 4和DeepSeek R1等前沿模型相提并论的模型。凭借完整的131K上下文,开发者现在可以在生产级编码应用中使用Cerebras,并在不到一秒钟内获得答案,而不是在GPU上等待数分钟。"Po1喜好网-记录每日喜好的科技时尚娱乐生活

Cerebras将其上下文长度支持从32K增加到131K Token——这是Qwen3-235B支持的最大值,增长了四倍。这种扩展直接影响了模型在大型代码库和复杂文档上的推理能力。虽然32K上下文足以应对简单的代码生成用例,但131K上下文使模型能够同时处理数十个文件和数万行代码,支持生产级应用开发。Po1喜好网-记录每日喜好的科技时尚娱乐生活

Qwen3-235B在需要深度逻辑推理、高级数学和代码生成的任务中表现出色,这得益于其在"思考模式"(用于高复杂度任务)和"非思考模式"(用于高效的通用对话)之间切换的能力。131K上下文长度允许模型摄取和推理大型代码库(数万行),支持代码重构、文档编写和错误检测等任务。Po1喜好网-记录每日喜好的科技时尚娱乐生活

Cerebras还宣布进一步扩展其生态系统,获得了DataRobot、Docker、Cline和Notion的支持。Po1喜好网-记录每日喜好的科技时尚娱乐生活

发展方向如何?Po1喜好网-记录每日喜好的科技时尚娱乐生活

大型AI一直在被缩小和优化,在性能、模型大小和价格方面实现了数量级的提升和降低。这一趋势无疑会继续,但会被能力、准确性、智能水平的提升以及跨模态的全新功能不断抵消。因此,如果你想要去年的AI,你的处境很好,因为它会继续变得更便宜。Po1喜好网-记录每日喜好的科技时尚娱乐生活

但如果你想要最新的特性和功能,你将需要最大的模型和最长的输入上下文长度。Po1喜好网-记录每日喜好的科技时尚娱乐生活

这就是AI的阴阳两面。Po1喜好网-记录每日喜好的科技时尚娱乐生活

展开全文
猜你感兴趣
拼多多「隐身」双十一

拼多多「隐身」双十一

纵然是在互联互通的大背景下,双十

11-19 117阅读
戴森设计大奖国际20强名单出炉

戴森设计大奖国际20强名单出炉

【锋巢网】首次有两支中国大陆赛

11-19 119阅读
丰田公开搭载氢发动机的混合动力车,加氢一次续航约 250 公里

丰田公开搭载氢发动机的混合动力

11 月

11-19 110阅读
中银300亿母基金加速推进

中银300亿母基金加速推进

银行

11-19 103阅读
年入上百亿,海尔旗下独角兽终止IPO

年入上百亿,海尔旗下独角兽终止IP

今年

11-19 109阅读
金鸡奖这一夜,世态炎凉、江湖职位,在王骁身上体现得淋漓尽致

金鸡奖这一夜,世态炎凉、江

11-19 104阅读
龙波 始终亲力亲为,哪个岗位有需要就扑在哪里 优秀新闻工作者 编辑⑨(龙波始终亲力亲为)

龙波 始终亲力亲为,哪个岗

为激励全市新闻战线认真践行“四向

11-19 104阅读
徐璐发文疑似分, 原来是误会一场!

徐璐发文疑似分, 原来是误

徐璐和张铭恩的恋情自从搬上节目

11-19 100阅读
高燃励志电影《倒数回击》定档11月20日 甜妹热辣“爆改”逆袭浴火人生

高燃励志电影《倒数回击》

  由洪子烜导演,温贞菱、丁宁主演的

11-19 94阅读
20岁大学生开车26天去上学引百万人围观:从中国南京开到英国杜伦

20岁大学生开车26天去上学

“我真的做到了!

11-19 110阅读
360浏览器兼容模式怎么设置?360浏览器极速模式怎么开?一文看懂

360浏览器兼容模式怎么设

360浏览器是我们使用最多的一款浏览器

11-19 115阅读
CS1.6怎么加机器人?CS1.6加机器人方法

CS1.6怎么加机器人?CS1.6

《CS1.6》也就是大家都玩过的反恐精英

11-19 187阅读
ePSXe模拟器安卓版怎么导入游戏?ePSXe模拟器安卓版导入游戏教程

ePSXe模拟器安卓版怎么导

ePSXe模拟器安卓版是一款非常棒的可以

11-19 158阅读
原子之心医院区域所有死者位置详细介绍

原子之心医院区域所有死者

在原子之心游戏里面想要达成招魂问卜奖

11-19 111阅读
饥荒饥饿腰带制作方法及制作材料分享

饥荒饥饿腰带制作方法及制

饥饿腰带是饥荒游戏里面的一件魔法物品

11-19 129阅读