大模型,开始集体变小
文 | 李炤锋 王欣逸 编辑 | 张雨忻 在深圳,林舟所在的AI创业公司只有十个人,大部分工作都靠 AI 来完成——每天数百个Agent(智能体)同时运行,它们分头写代码、做研究。 而驱动这些Agent的,一直都是OpenAI的GPT系列模型。 但随着团队交给Agent的任务越来越多,林舟发现GPT跟不上了——他们当时使用的GPT5.6,一次只能同时处理两三个任务。“GPT能处理的并发任务有限,会耽误我们的工作进度。”林舟说,团队开始寻找能让更多任务同时运行、调用价格也更低的模型。 DeepSeek V4.1 Flash成了新选择。9月以来,团队试用了Claude和几款国产模型,最后选中V4.1 Flash:它能完成手头的开发任务,反馈更快,调用费用也更低。林舟说,这是他们眼下“性价比最高”的选择。 今年更早的时候,Google CEO Sundar Pichai在 Google I/O大会上说,据他了解,有些公司到了5月,全年Token预算就已经快用完了。就以Google自己为例,其内部AI编程工具每天消耗的Token也从3月的5000亿涨到5 月的超过3万亿。 而就是在这次大会上,
AI 智能解读
(以下内容源于AI总结,供参考)
精简总结
大模型正集体推出参数更小、成本更低、推理更快的Flash版本,以应对高并发、高频次日常任务需求,替代部分旗舰模型使用场景。
对日常生活的影响
普通人可用更便宜、响应更快的AI完成写作、办公、分发等重复事务,智能体协作成为日常生产力工具。
理财投资建议
关注专注端侧部署、Flash模型优化及AI安全护栏的厂商;警惕过度依赖高参数模型估值的标的,重视性价比与商业化落地能力。