与Cerebras CEO对谈:250亿订单积压,AI算力需求早已满足

与Cerebras CEO对谈:250亿订单积压,AI算力需

正文:

嘉宾:Andrew Feldman,Cerebras的CEO及联合创始人;Robin Rombach,Black Forest Labs的CEO及联合创始人

主持人:All-In Podcast的主持人

原文标题:Open Source Wins,AGI Is Here,and Scorsese’s AI Toolkit — Cerebras & Black Forest Labs CEOs

在本期节目中,我们邀请了两位AI基础设施公司的首席执行官。Andrew Feldman是Cerebras的创始人,该公司专注于推理芯片,刚刚完成首次公开募股,并拥有250亿美元的订单积压。他多次强调,AI算力的需求早已被满足,不存在“建好了等人来”的情况,OpenAI、Anthropic、SpaceX和Google的需求远远超过供给。同时,推理(reasoning)的兴起使得计算密集度再度飙升,这正是快机器的竞争领域。Robin Rombach是Black Forest Labs的创始人,专注于生成式图像和视频模型(Flux系列),他之前发明的潜在扩散算法是当前图像和视频生成模型的基础。他最近与马丁·斯科塞斯合作,利用AI将导演的构思可视化;但他更兴奋的是,使用同一套多模态模型来拍摄电影并部署到机器人作为大脑。生成式视频的终极目标并不止于银幕,而是在物理世界中。

主持人:这样的建设规模前所未有。自长城和金字塔以来,人类没有投入如此庞大的资本、时间和智慧于同一项目。您实际上参与了这项事业,您的客户正在构建数据中心,您是其中的关键环节。2026年,Cerebras将会是什么样子?德克萨斯州的巨大工程又是什么情况?

我们所谈及的数据中心,预计未来几年将消耗的电力将超过地球过去50年的总和。单一建筑的规模可与足球场相媲美,所需电力超过中型城市。全美各地、加拿大、北欧、巴黎及整个法国、中东,甚至哈萨克斯坦、塔吉克斯坦和格鲁吉亚等地都在建设大型数据中心。几乎每个国家和州都希望能参与其中。

付款者包括OpenAI、Anthropic、SpaceX AI和Google,需求之大令人惊叹。有趣的是,此次热潮与以往许多技术革命截然不同:他们并不是在押注“建好了会有人来”,而是需求已经将产能预订一空。我们拥有250亿美元的订单积压。OpenAI、Microsoft和AWS都需要更多的数据中心。需求不再是等客户上门,而是客户已经在排队了。

主持人:这也催生了一个新词“token maxing”,即无限消费token。有些人质疑,这么大的需求是否真的创造了价值?

当然产生了大量价值,同时也有不少盲目尝试。我可以拿AWS早期的情况做对比,许多工程师都绕过了IT部门,直接用信用卡注册。确实有很多有用的应用,但有些后来想想“哦,不该这样做”。不过总体来看,还是盈利的,只是有些领域走了弯路。

我还记得1988年Costco在帕洛阿尔托开业时,大家像逛Safeway那样逛Costco,走遍每一排货架。这是一种很糟糕的购物方式,因为你会买下四件不需要的商品,每件22美元。后来大家学会了策略:直接去后面的鸡肉区,拿18个纸杯蛋糕为孩子的生日派对准备,简单明了。AI token的消费也类似,最初大家随意使用,但现在公司开始制定策略:哪些任务可以用开源模型,哪些任务必须使用前沿模型。我们开始像经营生意一样来管理AI了。

主持人:Sam Altman在AllIn上提到,下一步是推理,理解意图、制定策略以及与其他线程的代理进行交叉验证。从“猜下一个词”走到今天,Cerebras正好处于中心,因为推理就是推断,计算量极其庞大。

推理消耗大量token,这使得快机器成为了竞争的舞台。推理中的每一步都在内部消耗token,以前依靠大量时间来获取好的答案。而Cerebras快了15倍,意味着24小时的推理相当于其他公司几周甚至几个月的计算量。

今天早上我在BitTensor上试用了ZAI的GLM-52模型,给它无限算力,让它每小时告诉我全世界尚未被识别的趋势。它开始进行自我辩论:是应该在Hacker News和Reddit寻找,还是Instagram上的趋势更早出现?我看着一个推理模型在后台进行自我辩论,它正在进行推理。无限的token意味着无限的推理,利用Cerebras的速度快15倍,24小时的推理相当于别人几周的工作量。

主持人:Cerebras有自己的摩尔定律吗?内部讨论多久翻一番?

过去的芯片遵循摩尔定律,18个月翻一倍。然而,我们的芯片打破了这一规律,开辟了全新的轨迹。我的判断是,未来18个月会远超2倍。新架构仍有很大的优化空间。GPU架构已有20年历史,只能依靠缩小工艺节点维持,但新架构还有很多可以学习和调整的地方。

主持人:手握250亿的积压订单,您还需要跟上OpenAI的步伐,他们可能成为未来的竞争对手。您如何运营公司?

现在的硅片不会闲置,需求过于旺盛。但您说得对,OpenAI和Amazon也在开发自己的芯片。没有人愿意被依赖。超大规模厂商从x86时代吸取的教训是被Intel绑定;GPU厂商学到的是被少数几个超大规模客户所束缚,因此他们开始资助新云。开发自己的芯片,关键在于不完全依赖他人,至少掌控自己命运的重要一部分。

主持人:开源正在迎来一个重要时刻。我早期使用OpenClaude,后来转向Kimmy,发现使用Claude的token暴增,但Kimmy的表现并没有明显差别。开源模型开始进行推理,差距在今年突然缩小了。

你不会希望开着法拉利去超市。有时开跑车,有时开厢式车,孩子弄撒了Cheerios也不心疼。企业的情况也是如此:复杂问题交给前沿模型(OpenAI、Anthropic、Gemini),但大量日常问题只需稳妥的开源能力。想想一个公司有多少时间花在Workday中剪贴到Excel的琐事上?这根本不需要顶尖的数学能力,靠稳健的开源就足够了。

最近我又发现一个新趋势:在金融、医疗等受监管行业(HIPAA、FINRA)中,因担心数据泄露和智能主权被他人掌控,很多公司希望将模型放置在本地,使用开源版本以增加控制权。OpenAI几个月前发布了OSS 12B,表现尚可。但美国现在需要快速发展开源,要么是OSS 12B,要么是中国模型,国内的开源选择实在太少。NVIDIA也看到了这个机会,正在推广自己的开源模型,但Jensen对此仍有所犹豫,因为他的客户包括Sam、Dario、Elon和Sergey,推开源是否会与客户争夺市场?

Cerebras的立场比较中立,我们运行GLM、Kimmy、Qwen系列,也在运用OpenAI的闭源模型,还在使用GSK自有开发的模型、UAE的G42及MBZUAI的自有模型。智能主权是一个趋势。

主持人:Fable 5和o-56发布时,政府曾表示“暂缓发布”。Anthropic与政府的关系紧张,但如今开始缓和。您认为分步发布合理吗?模型真的存在危险吗?

我从未见过如此情景。但回过头来看,当一个模型在创造性思维上足够强大时,政府要求“分步发布”,我认为这

来源:Odaily星球日报

锦鲤(KoiPayment)原创作品,发布者:锦鲤KoiPayment,转载请注明出处:https://koipayment.com/2026/07/10/%e4%b8%8ecerebras-ceo%e5%af%b9%e8%b0%88%ef%bc%9a250%e4%ba%bf%e8%ae%a2%e5%8d%95%e7%a7%af%e5%8e%8b%ef%bc%8cai%e7%ae%97%e5%8a%9b%e9%9c%80%e6%b1%82%e6%97%a9%e5%b7%b2%e6%bb%a1%e8%b6%b3/

锦鲤KoiPayment
上一篇 2026年7月10日 下午9:48
下一篇 2026年7月10日 下午10:01

相关推荐

评论列表(8条)

  • 吃瓜群众 2026年7月10日 下午9:59

    这篇文章让我对AI算力的未来有了更清晰的认识,250亿订单积压,真是个惊人的数据!

  • 国际贸易达人 2026年7月10日 下午9:59

    Cerebras的CEO真的是个聪明人,看到AI算力的需求这么大,真是未来可期!

  • 市场研究员 2026年7月10日 下午9:59

    请问文章里提到的AI算力需求具体是指哪些行业呢?很想了解更多!

  • 缅甸观察 2026年7月10日 下午9:59

    看到Cerebras的技术进步,感觉金融科技领域也会受到很大影响,期待更多合作!

  • 金融科技爱好者 2026年7月10日 下午9:59

    这让我们明白AI算力的价值,未来金融行业可能会因为这些技术而变得更加高效!

  • 跨境电商人 2026年7月10日 下午9:59

    250亿的订单积压不简单,Cerebras应该是有足够的技术实力来应对这些挑战吧?

  • 东南亚观察者 2026年7月10日 下午9:59

    真是个有趣的对话,期待将来能看到更多类似的专题讨论!

  • 小李在金边 2026年7月10日 下午9:59

    不得不说,科技发展太快了,感觉我们还要不断学习才能跟上时代的步伐!

    了解 锦鲤(KoiPayment) 的更多信息

    立即订阅以继续阅读并访问完整档案。

    继续阅读

    商务咨询