LUNA · 1388

OpenAI 下调 GPT-5.6 Sol API 价格,长上下文输出价格降低 50%

比推消息, OpenAI 宣布限时下调 GPT-5.6 Sol 的 API 及 credits 价格,优惠至少持续至 11 月 21 日。其中标准短上下文 API 每百万输入 Token 价格由 5 美元降至 4 美元,输出由 30 美元降至 20 美元;长上下文输入由 10 美元降至 8 美元,输出由 60 美元降至 30 美元。API 新价格现已生效,ChatGPT Work 和 Codex 的 credits 价格也将陆续调整。Plus、Pro 和 Business 订阅自带使用额度则保持不变。此前 OpenAI 已分别下调 GPT-5.6 Terra 和 Luna 价格,此次 Sol 降价后,GPT-5.6 系列三档模型均已完成一轮价格调整。

17小时前
从4个模型到500多个,OpenRouter三年增长3万倍后被收购

从4个模型到500多个,OpenRouter三年增长3万倍后被收购

作者:Menlo Ventures编译:佳欢,ChainCatcher原标题:OpenRouter 背后早期投资人复盘投资始末今天,OpenRouter 宣布已与 Stripe 达成收购协议。距离 OpenRouter 于 2023 年正式推出,刚刚过去三年。OpenRouter 最初以“LLM 的统一接口”为定位上线,当时只支持 4 个模型:GPT-3.5、GPT-4、Together 的 GPT NeoXT 和 Cohere xlarge。公司成立之初基于两个核心判断:第一,AI 的使用规模最终会非常庞大,并渗透到各个领域;第二,市场上会出现大量不同模型,它们各有取舍,用户也会根据不同需求选择不同模型。事实证明,这两个判断都远远超出了当时的预期。自上线以来,OpenRouter 平台处理的 Token 数量增长了约 3 万倍,目前按年化计算已经超过 4500 万亿 Token,平台上的支出规模也达到了相当惊人的水平。与此同时,OpenRouter 支持的模型数量已经从最初的 4 个增加到 500 多个。图:从成立到被收购,OpenRouter Token 使用量增长情况Menlo Ventures 很幸运能够参与这段旅程。2025 年 3 月,我们通过与 Anthropic 合作设立的 Anthology Fund 参与了 OpenRouter 的种子轮融资。OpenRouter 创始人兼 CEO Alex Atallah 此前曾创办 OpenSea,后者估值一度达到 133 亿美元。他的联合创始人包括在 Discord 上认识的技术高手 Louis Vichy,以及执行力极强的 COO Chris Clark。2025 年 5 月,我们领投了 OpenRouter 的 A 轮融资,Matt 加入公司董事会,Deedy 担任董事会观察员。今年早些时候,看到 OpenRouter 的客户数量和收入迅速增长,以及公司围绕模型选择和评估构建更强“模型智能”能力的产品路线后,我们又继续加码了 B 轮融资。在科技行业,一个想法往往需要经过多年时间,才能从少数人的判断变成行业共识。而就在几周前,这件事发生了:从 Ramp 到 Cursor,超过 10 家公司几乎同时推出了自己的模型路由产品。短短几年时间,OpenRouter 已经成为 AI 时代最重要的公司之一。图:确定领投 OpenRouter A 轮时的合影乍看之下,Stripe 似乎并不是 OpenRouter 最自然的收购方,但两家公司实际上惊人地相似。两者都通过一个可以直接接入的 API,把原本复杂的交易流程变得简单,并从中收取一定比例的费用。只不过 OpenRouter 处理的是 AI 模型。按照 Stripe 一贯的说法,两家公司结合之后,仍然是在做同一件事:提高“互联网 GDP”。事实上,一年多以前,OpenRouter 就已经把自己称为“LLM 领域的 Stripe”。OpenRouter 的核心价值OpenRouter 是 Deedy 在 2024 年加入 Menlo 后最早接触的公司之一。这家公司几乎正好处于我们 AI 基础设施投资逻辑的核心位置。Menlo 在《2024 企业 AI 报告》中提出了两个投资 OpenRouter 所必须成立的判断:AI 支出会大幅增长,同时开发者不会只使用一个模型,而会同时采用多个模型。图:Menlo 最初发给 OpenRouter 的联系邮件作为同样会写代码、会实际使用这些模型的人,我们很早就意识到,不同模型在成本、延迟和性能之间存在非常明显的差...

2天前burnking#OpenRouter

具身智能机器人公司逐际动力拟赴港 IPO,募资最高 3 亿美元

比推消息,据彭博社报道,知情人士透露,阿里巴巴支持的机器人制造商逐际动力(LimX Dynamics)已秘密提交香港 IPO 申请,拟募资最高 3 亿美元。中国机器人公司上市浪潮再次壮大。LimX Dynamics 正与中信证券合作推进该交易。逐际动力(LimX Dynamics)是一家总部位于中国深圳的具身智能机器人公司,成立于 2022 年,专注于通用机器人的研发、制造与商业化。核心产品包括全尺寸人形机器人 LimX Oli 和 LimX Luna,以及模块化机器人 TRON 系列,并自主研发人形大脑系统 LimX COSA。以硬件设计制造、认知与运动智能融合、具身智能操作系统三大技术为核心,致力于推动物理世界的 AGI 落地,产品已应用于科研、商业服务、工业巡检等领域。公司获得阿里巴巴、京东等战略投资,近期完成多轮融资。

4天前#融资

Synchrony 与 OpenAI 达成合作协议

比推消息,美国金融服务公司 Synchrony 宣布与 OpenAI 达成企业合作协议,将部署 GPT-5.6 Sol、Terra 和 Luna 模型,并推出 ChatGPT 插件。

5天前

Codex 多 Agent 补上 Luna:Sol 当主管,便宜模型批量干活

比推消息,据监测,OpenAI 给 Codex 的多 Agent 功能补上了一个实用能力:Sol 现在可以直接把任务派给 Luna。 比如让能力最强的 Sol 负责拆任务和最后检查,再让多个更快、更便宜的 Luna 并行干活。此前 Codex 已经支持一个 Agent 调用多个子 Agent,也能让不同模型分工。但 Luna 有特殊限制,只能自己执行任务,不能被 Sol 这类上层 Agent 直接拉进团队。这次 OpenAI 把这个限制解除了。OpenAI 现在也明确推荐这种分工。Sol 适合复杂、开放式任务,Luna 则适合搜索、整理、提取、分类等明确又重复的工作。一个负责动脑和验收,一群负责批量执行。

6天前

DHH 横测编程模型:DeepSeek23 美元跑完,Fable 约 550 美元

比推消息,据监测,Ruby on Rails 作者 DHH 用同一个 Python 转 Rust 任务测试多款模型。DeepSeek Pro V4 Max 最终完成,用时约 2.5 小时,总 Token 成本 23 美元。Grok 4.6 花了 55 美元、约 1.5 小时,GPT-5.6 Sol 花了 43 美元;DeepSeek V4 Flash 和 GPT-5.6 Luna 没能完成。最初一轮由 Fable 主导,DHH 统计成本约 550 美元、耗时约 45 分钟。它把 TerminalTextEffects 从 Python 重写成 Rust,共用了约 1100 万 Token。启动时间从 87ms 降到 2ms,渲染速度提高 9.6 倍。不过对比有个前提。Fable 先写了一份 483 行的实施方案,Codex xhigh 审核后,其他模型都直接沿用了这份方案。因此这里更像是在比较不同模型执行同一方案的成本和效率。项目已经开源。仓库包含 354 项一致性测试,会逐帧、逐字节比较 Rust 版和 Python 原版,最终产物可编译成约 3.3MB 的静态单文件。

6天前

数据:LUNA 24 小时跌超 16%,RAD 跌超 22%

比推消息,据币安现货数据显示,市场出现大幅波动。LUNA 24 小时跌幅达 16.8%,RAD 24 小时跌幅 22.41%,并出现“冲高回落”状态。此外,TRB、MOVR、PYR、BICO 和 ACE 也均出现“冲高回落”状态,跌幅分别为 10.39%、13.5%、19.74%、14.43% 和 11.41%。同时,ROBO 触及今日新低,跌幅 8.61%。PROM 则在 5 分钟内小幅下跌,跌幅 3.19%。

10天前

数据:ZRO 涨超 12%,CRCLB 涨超 8%

比推消息,据币安现货数据显示,市场出现大幅波动。ZRO 24 小时涨幅达 12.54%,CRCLB 24 小时涨幅 8.1%,并触及今日新高。同时,AVA、CVX、COOKIE 和 0G 均出现“冲高回落”状态,分别跌幅 6.31%、7.13%、6% 和 5.3%。此外,STO 和 SAHARA 触及今日新低,跌幅分别为 5.77% 和 5.93%。LUNA 在 5 分钟内小幅上涨 3.31%。另外,MORPHO 触及本周新高,涨幅为 6.05%。

11天前
中美Token经济学:利润来源、溢价流向与兑现顺序

中美Token经济学:利润来源、溢价流向与兑现顺序

来源:华尔街见闻大模型算力狂飙与变现迟缓的错位,正在重塑全球AI产业链的利润分配格局。过去两年,中国市场日均Token调用量暴增超千倍,但2025年公有云MaaS(模型即服务)全年营收仅停留在30亿元量级。海量消耗尚未转化为对等的账面收入,中美两国在算力瓶颈与商业化路径上已走向截然不同的方向。东北证券分析师宋心竹在对Token经济产业链的剖析中提出,AI利润沉淀由稀缺溢价、代际溢价、一体化内部结算收益与迁移成本溢价四种机制构成。当前,利润正按上、中、下的顺序依次进入报表:上游算力底座率先兑现稀缺红利;中游模型层深陷同代能力商品化引发的通缩;下游应用层则承接算力降价红利,凭借时间累积的“迁移成本”构筑长期护城河。在溢价流向的终局上,受制于两国市场付费禀赋差异,美国的AI增量价值正沉淀于高价软件订阅体系,而中国市场的低价Token红利则直接外溢至应用层,等待计价方式全面迁移后的价值重估。算力投入逼近现金流边界,千倍调用量仅兑现30亿市场Token经济仍处重资产建设期。需求端,中国日均调用量由2024年初的约1000亿次飙升至2025年底的100万亿次。然而,多数Token消耗发生在大厂自有场景内部,未形成外部交易;经外部交易的部分,成交价已被极度压缩;加之应用层收费尚未全面向Token计价迁移,导致千倍的用量增长仅换来30.7亿元的公有云MaaS市场规模。与微薄的API收入对应的,是算力投入端的极度重载。资本开支强度已逼近经营现金流的覆盖边界。截至2026年二季度,美股四大云厂商的TTM(滚动十二个月)资本开支与经营现金流之比升至0.63至1.05。Alphabet首次出现单季负自由现金流,Meta自由现金流同比骤降91%。建设期的资金来源已从经营现金流外溢至资本市场。中国市场投入节奏明显分化,阿里巴巴资本开支强度跃居中概第一,百度则是八家头部算力买家中唯一收入回落与资本开支加码并存的公司。上游吃尽稀缺红利,中美算力瓶颈走向分野上游是当前唯一将利润稳稳装进报表的环节。基于供给缺口的“稀缺溢价”,直接造就了英伟达FY2026财年数据中心1937亿美元的收入。面对同样的算力饥渴,中美两国在同一道管制下形成截然不同的出清方式与产业瓶颈。美国的产业链瓶颈在于电力接入。ERCOT(得州可靠性委员会)等待接入批准的队列中,超1800个项目里约90%为数据中心,对应电力需求累计约474GW。审批与电力接入周期拉长,导致北美数据中心空置率降至历史低位。美国的稀缺最终按价格出清,涨价收益归于英伟达等头部大厂。中国的产业链瓶颈则直指算力芯片。在出口管制下,中国市场按管制配给出清,制度性拉动指向国产替代。2025年,本土厂商在AI加速卡市场的份额已占四成以上。新增算力向“东数西算”枢纽节点集聚,建设主体由公共部门、运营商与私人资本并举,形成公共部门主导的算力体系。开放权重击穿代际壁垒,中游模型沦为标准化产能同一能力档位的Token具备极强的可替代性,开放权重(开源)成为推平价格鸿沟的绝对主力。采购方更换供应商成本极低,竞争直接落在挂牌价上。测算显示,达到GPT-4同等能力的调用价格,每年降至约四十分之一。同代能力的价格正在全球范围内迅速追平。在AA智能指数约51分的档位上,中美四个主力模型(GPT-5.6 Luna、GLM-5.2、MuseSpark 1.1、Gemini 3.6 Flash)的混合价全部落入14至22元/百万Token的极窄区间。该档位的最低价并非来自中国厂商,而是以API形态入局的Meta。一旦能力档位被开源追平,Token即告商品化,价格只随用量与成...

11天前Wendy#AI #代币 #算力
OpenAI免费开放Luna,DeepSeek为何反而要涨价?

OpenAI免费开放Luna,DeepSeek为何反而要涨价?

作者:深潮 TechFlow原标题:OpenAI 向下沉,DeepSeek 往上走8 月 7 日,OpenAI 宣布,ChatGPT 每周活跃用户已经达到 10 亿,同时把 GPT-5.6 Luna 开放给免费用户,文本对话不限次数。前一天,多名 DeepSeek API 用户收到通知:公司计划近期整体上调 API 服务价格,“预计涨幅较大”,具体价格和执行时间等待后续公告。这似乎有点反常识。过去两年,中国大模型厂商最擅长的叙事就是极致性价比。DeepSeek 此前用不到 OpenAI 三十分之一的价格提供接近 GPT-4 水平的性能,被业内称为“价格屠夫”,梁文峰成为了“梁圣”,大家的共识是:国产大模型的核心优势,就是把 AI 的使用成本打到地板上。现在地板松动了,OpenAI 成了那个把东西免费送给全世界的人,而中国厂商却开始谈付费、谈提价。攻守之间,位置真的变了?OpenAI:免费不是慈善先搞清楚一件事:GPT-5.6 Luna 不是 OpenAI 最强的模型。它定位中等能力区间,处理日常对话、简单写作、基础翻译绰绰有余,但复杂推理和多步骤代码分析,仍要靠更高级的 SOL 系列。OpenAI 拿一个“够用就好”的模型,去覆盖最广的用户场景。这个策略有底气,也有代价。底气来自成本端。过去 18 个月,大模型推理的单位 Token 成本曲线陡峭得惊人:模型架构优化、量化技术成熟、推理引擎升级叠加在一起,同样的算力集群,今天能服务的请求量是两年前的几十倍。边际成本足够低的时候,免费就接近谷歌搜索的逻辑:入口免费,生态收钱。代价同样清晰。2026 年一季度,OpenAI 收入 57 亿美元,非 GAAP 经营亏损率 -122%,每赚 1 美元要倒贴 1.22 美元,全年预计净亏 140 亿美元。10 亿周活里,付费订阅者 5000 万,付费率约 5%。订阅费显然养不起这家公司,钱从别处来:广告业务上线 6 周跑到 1 亿美元年化收入;企业 API 持续扩张,Codex 每周 500 万用户,企业客户目前贡献了超过 40%的收入……换句话说,ChatGPT 的商业模型正在从“卖模型订阅”切换成“收平台税”:模型本身免费,长在模型之上的广告、企业服务和开发者生态才是收入来源。10 亿周活是这套打法的核心,它不需要每个用户掏钱,只需要用户每天打开它,再从少数高价值需求里收费。这是一套非常古典的互联网平台经济学,此前常被拿来和 Claude 的“企业市场,付费编程”路线对比,如今看,OpenAI 是铁了心要做 AI 时代的全民入口。DeepSeek:服务器撑不住了DeepSeek 的处境和 OpenAI 完全不同。V4 Flash 在 OpenRouter 全球调用量周榜登顶,单周处理 7.22 万亿 Token。据 OpenCode 数据,仅 8 月 1 日一天,V4 Flash 单日处理量就达到 8 万亿 Token。工作日高峰时段接口超时和卡顿频发,7 月中旬先上了峰谷定价机制(高峰翻倍),8 月 6 日直接预告全面大幅涨价。换个说法:用户太多,算力不足。过低的定价吸引了大量低频次、低付费意愿的调用,服务器资源被无效请求挤占,真正需要深度推理的企业和开发者反而得不到稳定体验。DeepSeek 需要把拿 AI 当玩具的用户挡在门外,让愿意为高质量推理付费的人留下来。豆包 6 月 24 日上线付费版(68/200/500 元三档月费,基础功能保持免费)是同一条逻辑线上的动作,3.45 亿月活,日均消耗数千万元推理成本,电商佣金补不回来。如今,国内大模型竞...

15天前burnking#AI #DeepSeek #GPT #OpenAI