文 | 李炤锋 王欣逸
编辑 | 张雨忻
在深圳,林舟所在的AI创业公司只有十个人,大部分工作都靠 AI 来完成——每天数百个Agent(智能体)同时运行,它们分头写代码、做研究。
而驱动这些Agent的,一直都是OpenAI的GPT系列模型。
但随着团队交给Agent的任务越来越多,林舟发现GPT跟不上了——他们当时使用的GPT5.6,一次只能同时处理两三个任务。“GPT能处理的并发任务有限,会耽误我们的工作进度。”林舟说,团队开始寻找能让更多任务同时运行、调用价格也更低的模型。
DeepSeek V4.1 Flash成了新选择。9月以来,团队试用了Claude和几款国产模型,最后选中V4.1 Flash:它能完成手头的开发任务,反馈更快,调用费用也更低。林舟说,这是他们眼下“性价比最高”的选择。
今年更早的时候,Google CEO Sundar Pichai在 Google I/O大会上说,据他了解,有些公司到了5月,全年Token预算就已经快用完了。就以Google自己为例,其内部AI编程工具每天消耗的Token也从3