机器学习 · 754
从Meta走出的Fireworks聊开源与闭源,谁会胜出?

从Meta走出的Fireworks聊开源与闭源,谁会胜出?

作者:Silicon Valley Vector 硅谷坐标编辑:Peggy,BlockBeats原标题:硅谷坐标 x Fireworks 联创 Benny Chen:开源模型、token 增速、推理优化和模型定制编者按:在开源模型加速逼近闭源前沿模型、推理价格持续下降的背景下,行业讨论正在从「谁拥有能力最强的模型」转向「谁能以更低成本把模型投入生产」。但当模型能力趋同、Token 消耗增长成为共识,一个更底层的问题开始浮现:企业真正愿意付费的,究竟是更便宜的模型调用,还是能够稳定完成具体任务的专属智能?近日,《硅谷坐标》主持人曹卿云与 Fireworks AI 联合创始人陈宇飞进行了一场对谈。Fireworks 位于模型与企业应用之间,主要为客户提供开源模型推理、性能优化和定制服务。相比单纯讨论开源能否追平闭源,陈宇飞的观察更接近真实工作负载:Token 流向哪里、企业为何付费,以及模型从概念验证走向生产还缺少什么。在这场对谈中,陈宇飞是将「开源与闭源谁会胜出」拆解为一组更底层的结构性问题:Token 增长能否转化为收入,通用能力能否替代垂直积累,低价模型能否通过企业评测,以及推理平台如何在云厂商和应用公司之间获得价值。第一,是开源模型的使用规模与商业价值正在分化。过去,能力追赶和调用价格是判断开源竞争力的主要指标;如今,Fireworks 平台每天处理约 40 万亿至 50 万亿个 Token,开源模型的实际使用量已经快速扩大。但免费流量、促销补贴和模型价格差异,会让 Token 统计高估部分需求。客户可能大量调用低价模型,却仍把最高预算交给效果最好的闭源模型。这意味着,开源的下一阶段不再只是扩大流量,而是证明其能够在高价值任务上达到甚至超过前沿模型,并把成本优势转化为付费意愿。第二,是通用模型与垂直模型开始沿着不同方向演进。过去,每次前沿模型升级,都可能直接淘汰一批微调模型;现在,法律、医疗、编程等垂直应用正在积累更细的评测、数据和工作流,其优化目标也与前沿实验室逐渐分离。通用模型需要提高能力上限,垂直模型则要在有限场景内稳定交付结果。前者可以解决更广泛的问题,后者却更理解用户如何定义「正确」。这意味着,垂直公司的壁垒并不只是拥有一个定制模型,而是能够持续把行业需求转化为评测体系,并随着基础模型更新反复迁移。第三,是企业 AI 落地的瓶颈正在从模型供给转向评测能力。过去,企业概念验证往往依赖试用体验和主观判断;现在,当 AI 进入呼叫中心、法律检索和医疗辅助等生产环节,仅凭「看起来效果不错」已经无法支持采购决策。企业必须知道模型在哪些任务上有效、何时失效,以及从闭源切换至开源会改变多少成本和质量。评测因此不再是附属工具,而是连接采购、训练与生产部署的基础设施。谁能定义任务、建立测试分布并持续更新标准,谁才真正掌握模型选择权。第四,是推理平台的价值正在从「卖便宜算力」转向组织模型、硬件与工作流。过去,推理优化主要被理解为降低单个 Token 的成本;现在,缓存、任务拆分、模型路由和上下文管理都可能直接改变任务完成率。不同模型不必争夺同一个位置,而可以分别担任执行者和顾问。Fireworks 的商业逻辑也由此成立:不自建重资产硬件,而是通过训练、定制和持续推理,将收入与客户模型的实际使用绑定。但这条路径的主要对手并非单一新云公司,而是能够同时控制算力、软件和客户入口的大型云厂商。第五,是开源模型崛起未必削弱基础设施需求,反而可能压缩模型层溢价,并把价值进一步推向推理和算力。科技巨头持续增加资本开支,也不只是计算短期回报,而是在衡量错过 AI 周期...

4天前律动BlockBeats#AI
解散AI Lab、半年砸846亿买卡,腾讯正在逆流而上

解散AI Lab、半年砸846亿买卡,腾讯正在逆流而上

作者:动察 Beating原标题:腾讯还有梦想2026 年 8 月 12 日,腾讯发布二季度财报。单季资本开支,527.8 亿元。三个月前,这个数字是 319 亿。再往前推一年,全年加起来也不过 792 亿。这家公司一向以花钱克制著称。它买卡的速度,曾经慢到让市场怀疑它是不是真的想上 AI 的牌桌。现在,它把花钱的速度在一年之内提到了这个量级。同一天的财报会上,马化腾说,腾讯正在「构建一个全新的、AI 赋能的腾讯」。混元改名叫 HY,Hy4 即将发布。这家公司上一次用「全新」形容自己,还是微信诞生的年代。腾讯还有梦想。它的梦想不只是 AI,它要重新学会做一家不安稳的公司。2018 年,潘乱在《腾讯没有梦想》里说腾讯是水一样的公司。水善利万物而不争,哪里有渠道,就往哪里流。水没有个性,所以水也没有梦想。水往低处流,这是天性,逆流是逆流者的事。2026 年,这家 28 岁的公司,做了件违反天性的事。它承认,八年前那篇文章说对了,承认水一样的活法,已经活不下去了。水5 月 5 日晚 9 点,《腾讯没有梦想》发表。一万三千字。夜里 2 点,刘炽平和腾讯公关总监张军在朋友圈回应。刘炽平说,腾讯是一个比外界想象更大的组织和生态,「把腾讯简化成一个产品的得失,一种战略的部署,一个人的意志,都太狭隘了」。2 点 19 分,一张疑似马化腾回应的截图开始在朋友圈流传。2 点 39 分,真正的马化腾才开口,是对一个关心他的朋友说「有批评蛮好。」随后,他说:「从写第一行代码开始,我的理想都是如何做出最好的产品,而不是赚多少钱。」白天,全国媒体几乎全文引用了那张疑似马化腾回应的截图,连张一鸣都在朋友圈替腾讯说话,说这是「堂吉诃德式的想象」,腾讯不仅强大,还在各个维度不断进化。张军那天一直在长途飞机上,他落地后说:「我们固然没有外界想的那么糟,但批评也让我们意识到,我们没自己想得那么好。」当然,当时关于那篇文章也有一些不同的声音。洪波说,文章里提到的很多是真问题,但这么大的公司,有唯一的正确答案吗?「或许,作者认为张一鸣就是那个唯一正确的答案。他有点迷信张一鸣。」那篇文章还记录了一个更早的故事。2011 年初,3Q 大战刚结束,腾讯开了一次总办会,讨论什么是腾讯的开放能力。马化腾让与会的 16 名高管,每个人在纸上写下他们认为的腾讯核心能力,总共得出 21 个答案。最后定下两个。资本、流量。资本这个词是刘炽平主张的。开放,就是把流量放出去,让它变成投资。流量开放,资本开放,「我不再自己做」。这两个词管了腾讯十年。微信管流量的入口,投资管流量的出口,中间是游戏和广告源源不断造出来的现金。京东的电商入口进了微信九宫格,搜狗接了搜索,美团接了本地生活。流量换股权,股权换盟友。十年里,腾讯市值涨了十倍,超过 Facebook。那篇文章发表的时候,它看起来仍然不可战胜。八年之后回头重读会发现,那篇文章几乎预言了腾讯后来每一次跌倒的方式。十年后的 2021 年 12 月 23 日,腾讯把 14.7% 的京东股票分给了自己的股东,市值约 1000 亿中国香港元。2022 年 1 月,减持 Sea,套现 32 亿美元。2022 年 11 月,又分掉 9.6% 的美团,约 1594 亿中国香港元。当年被定为「核心能力」的资本,被腾讯亲手拆掉了。水流了几十年,第一次开始往回走。第一场 AI 梦那篇文章里有一段,当年没有多少人注意。它写到了腾讯的 AI。AI Lab 做的围棋程序「绝艺」,先后败给了两个业余作品。一个是头条副总裁的个人爱好,一个是微信翻译团队几名工程师的业余之作。很少有人意识到,...

5天前动察Beating#AI
Jeff Dean 离职前最后一次对话:我低估了AI,也看清了创业者的唯一生路

Jeff Dean 离职前最后一次对话:我低估了AI,也看清了创业者的唯一生路

来源 | InfoQ编译 | 宇琪 策划 | Tina一年前,Google 首席科学家 Jeff Dean 在 AI Ascent 2025 峰会上预测:到 2026 年,可能出现能够全天候工作、能力接近初级软件工程师的 AI 系统。一年后,也就是 6 天前,他在一期 YC 访谈中承认,自己低估了 AI 的进展速度。模型处理复杂任务的能力,增长得远比他当时预想的更快。那么,在 Jeff Dean 看来,AI 接下来还会以多快的速度向前推进?创业公司又该如何在通用模型不断扩张能力边界的时代生存下来?今天凌晨,这期访谈又有了不同的分量。Jeff Dean 宣布,明天将是自己在 Google 的最后一天。效力 Google 27 年后,这位被誉为硅谷“程序员中的程序员”、深度参与 Google 系统架构和 AI 技术建设的传奇工程师,将与长期合作伙伴 Sanjay Ghemawat、Oriol Vinyals 和 Quoc Le 共同创立 Discovery Loop,一家聚焦机器学习、科学和工程前沿研究的公益性公司。Google 将作为创始投资方和云计算合作伙伴继续与他们合作。据 WIRED 披露,这个创业想法其实只是几周前才浮出水面。为了挽留这支核心团队,Alphabet CEO Sundar Pichai 还曾在多次会面中试图说服他们“别摘工牌”。但最终,几人还是决定离开大公司体系,去换取一家初创公司才有的乐趣、速度和自由。截图来自:https://x.com/JeffDean/status/2085035498222002595/photo/1Jeff Dean 在告别信中写道,自己见证了 Google 从一家只有 25 人的公司,成长为拥有 19 万多名员工的科技巨头。如今,Google 已有 13 款产品的用户规模超过 10 亿。从搜索、邮件、翻译和视频,到大规模计算、自动驾驶和 AI 系统,他参与建设的技术几乎贯穿了 Google 的整个发展历程。而促使他们离开的一个重要原因,也恰恰是大公司难以摆脱的惯性。正如 Oriol Vinyals 所说,在大型组织内部,要推动任何激进变化,都必须先克服层层阻力;他们想做点不一样的东西。颇有意思的是,迄今为止,这家新公司甚至还没来得及招人、租办公室,至于谁来当 CEO,团队内部短暂停顿后,大家把目光投向了 Jeff Dean——“我想应该是我吧。”他说。因此,这期发布于 Jeff Dean 离职前夕的访谈,也像是他站在职业生涯转折点上,对 AI 下一阶段的一次集中判断。节目中,他与 YC 合伙人 Diana Hu 讨论了 AI 从“模型为中心”转向“上下文工程”的范式变化、推理硬件正在出现的巨大机会,以及创业者如何在通用模型越来越强、越来越多应用可能被模型直接吞并的时代,找到真正值得坚守的生存空间。本文基于该访谈视频整理,经 InfoQ 编辑。太长不看版Q:去年你说到 2026 年会出现能力接近初级工程师的 AI。一年过去了,这个预测打脸了吗?A:相当准确,但我低估了一件事:模型处理越来越复杂任务的能力,增长速度比我预想的快得多。而且这种能力正在溢出到编码之外的领域,基于 Agent 的系统开始真正崭露头角。Q:对 2027 年的大胆预测是什么?A:深度学习系统将实现全自动的问题分解和自动化实验循环:把问题拆成子问题,自动跑实验,整合结果,得到一个改进后的系统。而且这不只适用于机器学习,任何有可衡量目标的科学和工程领域都能用上。Q:2001 年 Google 把搜索索引装进内存,...

9天前burnking#AI #Jeff Dean #谷歌

Discovery Loop 以 100 亿美元估值寻求 10 亿美元融资

比推消息,知情人士透露,前 Google 首席科学家 Jeff Dean 创办的 AI 初创公司 Discovery Loop 正洽谈融资 10 亿美元,对应估值约 100 亿美元,目前具体融资条款仍可能发生变化。Discovery Loop 旨在通过自动化机器学习、科学和工程以及并行执行数千项实验,加速科学与工程领域的发现。其初始融资由 Radical Ventures 和 Khosla Ventures 领投,Lightspeed、Kleiner Perkins 和 Doerr Capital 参投,Alphabet 为创始投资者及云服务合作伙伴。Discovery Loop 创始团队还包括 Sanjay Ghemawat、Quoc Le 和 Oriol Vinyals 等前 Google 核心研究人员。

9天前

杰夫·迪恩披露离开谷歌最后 48 小时:1500 人挤进小咖啡厅送别

比推消息,据监测,谷歌前首席科学家杰夫·迪恩在 KDD 2026 首次晒出离职前最后两天的完整日程。宣布离职当天,他先向 139 名关系密切的同事告别。下午约 1500 人参加送别会,现场咖啡厅只能容纳约 300 人。晚上 10:30,他发现内部聊天里多了 400 条告别消息,一直回到凌晨 2:30。第二天早上又来了 250 条内部消息和 500 封抄送到个人邮箱的邮件。到下午 5:20,他才合上笔记本。离职消息本身一周前已经公布。迪恩是谷歌第 30 名员工,在公司工作近 27 年,最终担任首席科学家。他与 Sanjay Ghemawat、Oriol Vinyals、Quoc Le 共同创办 Discovery Loop,希望让 AI 自动提出、运行和评估实验,同时并行跑数千个实验,用于机器学习、芯片、药物和材料研究。Alphabet 还是公司的创始投资方和云合作伙伴。

10天前

谷歌四名老将组团创业,要让 AI 自己跑科研实验

比推消息,据监测,原 Alphabet 首席科学家 Jeff Dean 离开任职近 27 年的谷歌,与 Sanjay Ghemawat、Oriol Vinyals 和 Quoc Le 创办 Discovery Loop。四人的履历覆盖谷歌底层系统、Google Brain、Gemini 和 AlphaFold 等核心项目。Discovery Loop 准备先从机器学习研究入手。研究人员提出问题后,AI 会写代码、运行实验、分析结果,再据此安排下一轮尝试。过去需要研究员反复手动推进的工作,可以同时展开数千组实验,人类主要负责确定目标和判断结果。团队会先拿自己做试验,用这套系统改进模型和技术架构。如果方法有效,再扩展到芯片设计、生物研究、新药和新材料等领域。公司目前还没有确定办公室,正在招聘创始团队,产品仍处于早期阶段。Discovery Loop 成立时已经获得种子投资。Alphabet 是创始投资方,也会通过谷歌云提供首年算力。Radical Ventures 和 Khosla Ventures 联合领投,Kleiner Perkins、Lightspeed 等机构参投。融资金额和估值尚未披露,种子轮仍在募资。

16天前
天塌了?谷歌AI再失四将,市值蒸发近2000亿美金!

天塌了?谷歌AI再失四将,市值蒸发近2000亿美金!

当地时间8月5日,谷歌再爆人事巨变:包括Jeff Dean、Sanjay Ghemawat、Oriol Vinyals和Quoc Le在内的四名核心技术人物集体离职,成立人工智能创业公司Discovery Loop。Quoc V. Le、Oriol Vinyals、Jeff Dean和Sanjay Ghemawat(从左至右)同一天,Google DeepMind最高管理层也出现重大调整。DeepMind创始人Demis Hassabis淡出日常经营,转任Alphabet首席科学家及Google DeepMind董事长,原首席技术官Koray Kavukcuoglu接管日常运营和模型研发。消息传出后,Alphabet股价盘中一度跌超5%,市值蒸发约2500亿美元,尾盘跌幅有所收窄。      Will $GOOGL Share Price drop to $350 by August 14, 2026?Yes      No    Powered by        Moment      Predict. Earn Points. Unlock the Airdrop编辑删除    otherWill $GOOGL Share Price drop to $350 by August 14, 2026?YesNoYES: $GOOGL official closing price is $350.00 or lower on or before August 14, 2026. NO: $GOOGL stays strictly above $350.00 at market close on August 14, 2026. Rule: Prices apply to Regular Trading Hours only. Threshold adjusts proportionally for any stock splits before expiry.other2026-08-162026-08-16T06:59:59.999Zhttps://moment.vision/mapi/uploads/openai/images/20260807060428_e11beecd1f8abedc.jpg6a7575b12988fda4ba3fa747表面上看,这是一次高管离职引发的市场恐慌。但真正让华尔街不安的,并不是谷歌少了几个人,而是一个越来越清晰的信号:最了解谷歌AI技术现状、最有能力判断未来路线的人,正在用脚投票。一支完整的AI创业团队“出走”这四名离职者中,Jeff Dean是谷歌最具象征意义的技术人物之一。作为谷歌第30号员工,Jeff Dean几乎参与了公司从搜索创业公司成长为全球计算与AI巨头的全过程,长期领导谷歌人工智能和基础设施研究,也是Gemini技术体系的重要负责人。Sanjay Ghemawat则是谷歌大规模分布式系统的奠基人物之一。谷歌搜索、云计算和超大规模AI训练所依赖的底层基础设施,与其长期工作密切相关。Oriol Vinyals是DeepMind研究副总裁,也是Gemini技术负责人之一,在序列建模、深度学习和大模型研究领域拥有广泛影响力。Quoc Le同样是Google Brain联合创始人,长期主导大规模神经网络、AutoML和模...

17天前Wendy#AI #Gemini #原创 #谷歌
八万本金到DeepSeek震动硅谷,梁文锋走了一条怎样的路?

八万本金到DeepSeek震动硅谷,梁文锋走了一条怎样的路?

作者:动察 Beating原标题:梁文锋青年往事:八万本金、一台菲亚特和一个人的长征2025 年 1 月 27 日,星期一。梁文锋正在吴川的一片球场上,和几个初中同学踢球。七天前,DeepSeek-R1 发布。七天后,消息越过太平洋,在美国资本市场掀起震荡。英伟达股价单日跌去超过 16%,市值蒸发近六千亿美元。美国媒体翻出冷战年代的旧词,把这一天称作新的「斯普特尼克时刻」。DeepSeek 已经登上中美两国应用商店免费榜榜首。硅谷的人在一夜之间学会了念一个陌生的中国名字,采访邮件从世界各地涌向杭州,记者四处打听梁文锋去了哪里。没有人找到他。那天下午,他穿着球衣,在粤西一座县级市的球场上来回奔跑。球落到脚边,他接住,转身,再传出去。场外的世界正在为他震动,球场上的比赛还在继续。第二天是除夕。梁文锋回到米历岭村,村口已经拉起一条横幅,红底白字写着:「热烈欢迎文锋,家乡的骄傲与希望。」游客一拨接一拨地来,站在横幅下面拍照。有人弯下腰,从路边抓起一把泥土,小心收好,像是想从这座村庄里带走一点好运。梁文锋的高中同学陈先生告诉记者,他答应了会回吴川过年,只是回来以后,要找个地方躲起来。米历岭村的孩子1985 年,梁文锋出生在吴川市覃巴镇米历岭村。吴川在粤西,三面被江水环抱,南边朝着海。鉴江从北面一路下来,到了这里忽然转过一道弯,再向南流入大海。过去跑水路的商船常在江湾停泊,岸边货栈相接,人声嘈杂,这座县城因此得过一个颇有气势的名字,「小佛山」。吴川也相信读书。清代状元林召棠的故乡霞街村,离米历岭村不远。县志里记载着这里出了一个状元,二十名进士,一百六十五名举人。几百年间,一代代年轻人从这里出发,沿着同一条窄窄的路,去往县城、省城和京城。功名早已成为旧事,读书能够改命的念头,却一直留在这片土地上。米历岭村也有自己的故事,村里老人提起先辈,会说到抗日将领梁华盛,也会说到 1936 年从中山大学毕业的梁太熙。按照村里的记载,解放以后,已有近百名学生从这里考入全国重点大学。可梁文锋长在九十年代。那是广东的金钱年代,工厂在招人,生意在冒头,沿海的城市一天一个样。一个年轻人肯吃苦、敢闯荡,未必需要在教室里坐很多年,也有机会挣到从前不敢想的钱。相比之下,读书太慢了,要一年一年熬,最后能换来什么谁也说不准。村里不少家长认定读书没有用,甚至专程走到梁家,劝他的父亲别再让孩子念下去。那时,米历岭村几百年积攒下来的功名想象,正被广东新鲜、滚烫的财富故事盖过去。很多年后,梁文锋在一次采访里说起这段往事:「我是八十年代在广东一个五线城市长大的。我的父亲是小学老师,九十年代,广东赚钱机会很多,当时有不少家长到我家里来,基本就是家长觉得读书没用。但现在回去看,观念都变了。因为钱不好赚了,连开出租车的机会可能都没了。一代人的时间就变了。」「一代人的时间就变了。」这句话是说九十年代,也是说 2024 年。说这话的时候,他正在做另一件同样慢、同样难以解释的事。梁文锋的父亲在梅菉小学教书,后来做了教导副主任,母亲也是教师,在边岭小学任教。这个家庭与科研没有多少关系,阁楼上却常年堆着书。据地方媒体报道,藏书最多时有上千本。父亲给家里定过两条规矩。饭桌上不谈学习,只谈一家人的生活;吃过晚饭,全家人各自找一本书读。梁文锋考得好不好,父亲很少追问。他更常说的一句话是,解决问题比分数重要。梁家最值钱的电器,是一台飞跃牌收音机。黑色的外壳,金属旋钮,一根可以一节节抽长的天线。拧动开关,喇叭里先传出沙沙的电流声,调准频率以后,遥远地方的声音才从噪声里慢慢浮出来。梁文锋读四年级时,把这台收音机拆了。螺丝卸下来,...

17天前burnking

梁文锋基金也在亏损?幻方量化多只产品年内收益转负,单月跌幅超 20%

比推消息, 私募排排网统计数据显示,截至2026年7月31日,梁文锋旗下幻方量化对外展示的9只主流量化产品中,8只年内收益由正转负,仅九章幻方中证500量化多策略2号勉强维持0.04%微弱正收益。其中,有多只产品单月净值跌幅突破20%。作为国内量化私募赛道的标杆机构,宁波幻方量化由梁文锋创立,长期稳居百亿量化梯队。与其他量化机构不同,幻方是国内少数真正实现“AI全链路赋能投资”的私募管理人,梁文锋同时也是国产大模型DeepSeek创始人。幻方长期自建算力集群,依靠机器学习、深度学习模型搭建选股与交易体系,一度被市场视作AI量化的行业范本。过去数年,幻方旗下中证500、中证1000指数增强产品持续跑出亮眼超额收益,依靠稳定业绩持续吸引高净值资金入场,巅峰时期管理规模曾突破千亿元。但本轮净值集体回撤,打破了投资者对于AI量化“穿越波动”的固有预期。(界面新闻)

17天前

字节 OpenViking 核心贡献者开源 LoopX:让 Agent 连续跑 200 小时也不失忆、不跑偏

比推消息,据监测,字节跳动 AML 高级机器学习工程师、OpenViking 核心贡献者黄瑞腾开源了 LoopX。它是一套面向长程 Agent 的控制系统,让 Codex、Claude Code 等 Agent 在任务跨越多天、多次中断后,仍能接着原来的目标往下做。LoopX 已公开两条跨越 220.7 和 272.9 小时的真实任务轨迹。期间经历多轮执行、等待、人工判断、模型切换和任务恢复,Agent 仍能找回当前目标、已有证据和下一步。它把目标、待办、权限、证据和等待条件放到模型上下文之外。Agent 每次只做一小步,验证结果后再写回状态。换会话、换模型或程序重启,都能从最新进度继续。黄瑞腾参与开发的 OpenViking 负责保存和检索 Agent 的记忆、资料与技能;LoopX 则管理任务做到哪里、下一步做什么、何时需要人来判断。前者像长期记忆,后者更像项目经理和可执行看板。目前,LoopX 已用于自动修复代码问题、AutoML 实验和长期研究。

19天前