月之暗面 · 117

字节讨论训练超 5 万亿参数模型,Seed 基模团队调整架构

比推消息,据晚点 LatePost 报道,字节跳动正在讨论训练参数规模超 5 万亿的大模型,超过阿里 Qwen 3.8-Max(2.4 万亿)和月之暗面 K3(2.8 万亿),为目前国内已知最大规模方案。该计划仍处早期,不代表最终一定发布。新模型拟由 Seed Foundation 负责人项亮主导,并与大语言模型预训练数据负责人沈科合作,Seed 正据此重新梳理组织、划分职责并分配资源。两周前,字节跳动创始人张一鸣与 Seed 负责人吴永辉召开全员会。张一鸣安抚团队称训大模型本就很难,一段时间内可接受落后,希望以追求智能上限为目标、跻身世界第一梯队;他认可编程是当前关键方向,主张整合火山引擎、飞书与豆包资源以构筑算力和数据优势,同时提醒勿被单一热点牵着走。他表扬 Seedance 的差异化领先,并明确反对蒸馏,认为其难以真正超越,应从更底层构建 AGI 壁垒,并表示公司将在 AI 上持续加大投入。过去半年 Seed 多模态表现突出,Seedance 2.0、Seedream 等带动火山引擎 MaaS,但语言模型 Seed 2.0 市场反响有限,Coding 能力落后影响收入结构。字节已高薪引入郭达雅专攻 Coding,并收拢相关资源。面对行业普遍做大模型尺寸的趋势,字节希望以更大规模争取弯道超车,同时推动取消赛马、打破部门墙,集中力量攻坚。

3天前

里昂:智谱 GLM-5.3 后训练能力显著提升,维持跑赢大市评级

比推消息,据金十报道,里昂发表研究报告指,智谱 (02513.HK) GLM-5.3 API 即日起开放调用,在复杂编码及长周期代理任务方面展现国内同业中领先性能,虽然参数规模较小,但在一众基准测试中都取得开放权重 SOTA 表现,并在 Artificial Analysis 智能指数中获得 60 分,与 Kimi 3 持平,超越通义千问 3.8 Max。该行估算 GLM 模型的 OpenRouter 收入份额已从今年 1 月的 1% 升至 7 月的 7%,领先 DeepSeek 的 6% 及月之暗面的 3%。认为 DeepSeek 近期加价反映行业竞争健康,而 GLM 5.3 已重夺帕累托前沿地位。近期股价疲弱或反映市场对 Anthropic 年化经常性收入减速的过度反应,维持智谱跑赢大市评级,目标价为 2061 港元。

3天前
为什么资本追逐 AI Native,不再理睬互联网老登

为什么资本追逐 AI Native,不再理睬互联网老登

资本不奖励守旧,不是因为守旧的人有错。是守旧的部分已经明码标价,没有信息差,也就没有超额收益。2026 年上半年,全球风险投资 5100 亿美元,一个半年超过了 2025 全年的 4400 亿。七成以上进了 AI,OpenAI 和 Anthropic 两家拿走 2170 亿,占 43%。钱多到这个份上,你会以为人人都能分一点。事实是分配比总量更极端,而且第一道筛子不筛行业,筛人。被筛掉的那一类,现在有个不太客气的叫法:互联网老登。先说死一件事:本文里的「老登」跟年龄没关系。它指的是一套在移动互联网周期里成型、被反复验证、给持有人带来过巨大回报的方法论。持有它的人可能四十五岁,也可能三十二岁。被重新定价的是这套方法论,不是出生年份。把这两件事搞混,是老登最常犯、也最舒服的一个错——因为如果问题是别人年龄歧视,你就一个字都不用改。01什么叫 AI Native这个词已经被用烂了。会用 ChatGPT 不叫 AI native,公司名里带个 AI 也不叫,二十几岁更不叫。真正把人分开的是三条。第一条,出发点是模型,不是需求。老登做产品的顺序是:看用户要什么,写成需求,找技术实现。AI native 的顺序反过来:先摸清模型今天能干到哪一步、明天可能到哪一步,然后从这个能力边界往外长产品。前者把模型当工具,后者把模型当地基。这两种人做出来的东西,第一版看不出差别,到第三版差出一个物种。第二条,组织的默认单位不是人。互联网时代的分工,是把一件事拆给十个人。AI native 公司的分工,是把十件事收给一个人加一堆 agent。国内一家应用层公司的 CEO 说过,团队不到十个人,但有大量 AI 在夜里干活,员工每天早上第一件事是检查 AI 前一晚交的活。Cursor 那边更极端,公开报道里提到公司没有产品经理,工程师自己写代码、自己跟用户聊、自己参与招人。第三条,信息是一手的。AI native 的输入来源是论文、模型卡、GitHub 的 issue、X 上的原始讨论、自己跑的 eval。老登的输入来源是行业峰会、闭门会、券商报告、公众号解读,以及找人喝咖啡。这一条最不起眼,杀伤力最大,后面单独说。三条都满足,二十五岁是 AI native,四十五岁也是。三条都不满足,二十五岁照样是老登。AI native 是个状态,不是个年龄段。麻烦在于,这个状态的入场券是作品,不是履历。02两张名单把这一轮的结果摊在桌面上,是两张名单。第一张全是 AI native 的公司。它们的估值不是在涨,是在换量级。名单一 · 上游OpenAI 2026 年 Q1 单轮融资 1220 亿美元,投后 8520 亿美元,史上最大一笔私募融资。Anthropic Q2 单轮 650 亿美元,投后 9650 亿美元,约占该季度全球风投总额的一半;5 月的收入运行率已到约 470 亿美元。DeepSeek 2026 年 5 月首轮融资约 700 亿元人民币。同年 4 月,梁文锋将直接持股由 1% 提至 34%,通过关联主体合计控制约 84.29% 股权。月之暗面(Kimi) 2025 年 12 月估值 43 亿美元;2026 年 1‒2 月连做三轮至 180 亿;5 月 D 轮约 20 亿美元、投后破 200 亿;7 月一轮超 35 亿美元、投后 350 亿;Pre-IPO 目标投前 500 亿。ARR 3 月破 1 亿、5 月破 2 亿、6 月站稳 3 亿美元,API 占七成以上。智谱 · MiniMax 2026 年初先后登陆港股,市值均破千亿元人民币,国内首批上市的大模型公司。第二张...

4天前Wendy#AI #DeepSeek

月之暗面(Kimi):警惕冒用公司名义虚假融资,不存在所谓朋友基金或特殊通道

比推消息,月之暗面(Kimi)发布严正声明称,针对市场上冒用公司名义进行虚假融资、涉嫌违法犯罪的行为,公司已向公安机关反映,并表示将追责到底。 月之暗面强调,不存在所谓朋友基金或特殊通道,不存在所谓老股份额或预留额度,也不存在所谓官方代理或授权中介,提醒市场参与者警惕相关虚假信息及可疑交易。 本文由GENG赞助,Build Your Fortune on GENG (https://geng.one)

8天前burnking
Kimi K3币圈诊断:两周扫遍501个项目、1280个高危隐患

Kimi K3币圈诊断:两周扫遍501个项目、1280个高危隐患

作者:克洛德,深潮 TechFlow原标题:Kimi K3 币圈诊断:两周扫遍 501 个比特币项目、1280 个高危隐患深潮导读:一支志愿者组成的「比特币红队」用月之暗面的 Kimi K3 在两周内扫了 501 个比特币开源项目,记录 7958 条发现,其中 1280 条被评为高危或严重。干这件事的之所以是中国模型,是因为 OpenAI 和 Anthropic 以安全为由拒绝了这些防守方。如果你的币放在某个多年没更新的钱包或节点软件里,这篇值得读完。8 月 13 日,比特币红队成员、Cashu 协议创始人 Calle 在 X 上总结了这场行动的阶段性结论,推文获得近 26 万次查看。他的原话很直白:「几十年的开源代码,和两周的 Kimi K3 撞在一起,结果就是所有东西都是破的,比特币在燃烧。」一切始于一个卷走 1 亿美元的钱包漏洞7 月 30 日,硬件钱包 Coldcard 被爆出固件缺陷:设备生成助记词时退回到一个可预测的软件流程,安全芯片只提供了 32 位熵,有效密钥空间只剩约 43 亿种可能。攻击者按图索骥,分多波抽干用户钱包,确认损失超过 1 亿美元,疑似总损失接近 1.3 亿美元。Bitcoin Magazine 罕见地发布了「立即转移资金」的紧急通告。这场灾难直接催生了比特币红队。Calle 和托管保险公司 AnchorWatch 的首席执行官 Rob Hamilton 牵头,数十名贡献者参与,非营利机构 OpenSats 报销了大部分算力开销,对几乎整个比特币开源生态做了一遍 AI 审计。两周扫完 501 个项目,但发现不等于漏洞到 8 月 8 日,这支队伍用上百小时扫完 501 个项目,记录 7958 条发现,1280 条被评为高危或严重。这些数字需要拆开看: 在第 108 小时的节点上,只有 24.7% 的发现被动态复现,29.4% 上报给了项目方,AI 审计会有误报和重复,人工核验仍在进行。但「水分论」挡不住最硬的那个案例。 支付软件 BTCPay Server 的官方发布记录显示,红队成员 Bruno Garcia 和 Ben Carman 报告的一个严重漏洞(双因素认证绕过)在被修复前已经遭真实利用,攻击者借此拿到节点的管理凭证,进而控制了关联的闪电网络钱包。BTCPay 连发两个安全版本,社区为受害者设立了追回悬赏,基金会另拨 0.21 枚比特币注入红队基金。维护者们用行动给这批发现投了信任票。美国模型在道歉,中国模型在找漏洞为什么主力是 Kimi K3 而不是 GPT 或 Claude?因为美国模型不接这活。 Rob Hamilton 自述,他完成全部身份验证后,用 OpenAI 的模型分析一个已公开披露的代码库,不到 20 分钟就被拒。 比特币核心贡献者 PortlandHODL 的对比在社区疯传:同一份代码,美国前沿模型的回答是「你说得对!」,中国开源模型直接找出 78 个严重漏洞。Hamilton 的吐槽更扎心:「我现在基本上是在求 Xi 别让我的软件被黑。」8 月 10 日,超过 70 家托管商、交易所、矿企和开发组织联名签署比特币政策研究所的公开信,要求前沿 AI 实验室为可信的防守方开放访问权限。Galaxy 研究主管 Alex Thorn 的联署留言写道:「美国人不该被迫依赖中国 AI 来保护自己。红队需要这些模型。」 不过也要给狂欢泼点冷水:英国 AI 安全研究所与美国 CAISI 的联合评测显示,Kimi K3 在漏洞开发测试上强于 GLM-5.2,但仍落后于美国最强闭源模型。防守方不是选最强的,...

8天前burnking#AI #Anthropic #OpenAI #比特币 #钱包

Kimi CLI 前作者:模型越强,Harness 反而会越厚

比推消息,据监测,Raft 创始人、Kimi CLI 前作者 Richard Qian 提出一个反常识判断:模型越强,Agent harness 不一定越薄,反而可能越来越厚。System Prompt、专用 Tool、Subagent 这些东西都可能慢慢消失。模型越来越聪明后,很多固定流程可以直接交给模型,最后甚至只留一个 Bash 工具。但 Agent 一旦开始长期工作、互相协作,新的问题马上冒头:谁负责什么、任务做到哪了、上下文怎么同步、多个 Agent 怎么避免重复工作和互相冲突。这些都得由模型外面的系统解决。Richard 离开月之暗面后做的 Raft,实际上就在补这一层。它把 Claude Code、Codex、Kimi CLI 等 Agent 拉进同一个工作区,让它们在频道里聊天、认领任务、读历史消息,再互相交接工作。模型正在吃掉旧 harness,但 Agent 能做的事越多,外面的协作系统也会越来越复杂。

12天前

FT:月之暗面正重组股权结构并引入国资股东,以获监管批准赴港上市

比推消息,据英国《金融时报》报道,中国 AI 初创公司月之暗面(Moonshot AI)正在调整公司架构,并引入多家国资背景投资者,以争取监管部门批准其赴港上市。月之暗面旗下 Kimi K3 模型近期缩小了与 Anthropic 领先模型之间的性能差距,并受到开发者欢迎。公司计划通过首次公开募股(IPO)筹集资金,用于下一阶段大模型研发和业务扩张。在上市前,月之暗面可能需要拆除现有的红筹架构。由于其核心业务此前由境外实体控制,并通过海外投资者募集美元资金,中国监管部门对部分拥有境外架构的科技企业境外上市提出限制,导致包括月之暗面、阶跃星辰(StepFun)在内的多家 AI 公司暂停 IPO 准备。据悉,月之暗面上周已将中国境内主体由有限责任公司变更为股份有限公司,这是其推进上市的重要一步。公司目前正与投行及律师团队协调,解决海外投资者持股转移问题。一名投资者透露,月之暗面近期已向股东通报,仍在推进境外实体架构调整,尚未确定如何将海外股东权益转移至境内主体。可能方案包括海外投资者设立境内投资主体持股,或先出售境外股份后重新认购境内股份,但均涉及较长审批流程。融资方面,月之暗面近期完成两轮融资,其中一轮估值约 300 亿美元,另一轮完成后估值预计达到 500 亿美元。公司此前吸引了国家人工智能产业投资基金等国资机构参与投资,最新股东名单还包括全国社保基金、上海及贵州地方政府引导基金以及人民日报旗下投资主体。 8 月 3 日,此前市场消息称月之暗面计划最早于本月内提交香港 IPO 申请,或募资约 30 亿美元。对此,月之暗面回应称消息不实。

14天前
币圈要复苏了?X创作者奖励计划引热议;月之暗面即将上市...

币圈要复苏了?X创作者奖励计划引热议;月之暗面即将上市...

亲爱的读者朋友们好~过去24小时,X上的KOL们在聊什么呢?注:以下内容整理自X平台,均为个人观点,不代表本平台立场,更不构成投资建议。币圈要复苏了?X推出新创作者奖励计划,意想不到的是...月之暗面即将上市Twitter:https://twitter.com/BitpushNewsCN比推 TG 交流群:https://t.me/BitPushCommunity比推 TG 订阅: https://t.me/bitpush

14天前Wendy#KOL

月之暗面的 Kimi K3 在安全测试中突破沙箱范围,因沙箱配置错误

比推消息,据 Wired 报道,安全测试中,月之暗面的开源模型 Kimi K3 在安全测试中突破沙箱范围并访问了互联网,试图通过 GitHub 寻找测试答案。美国安全初创公司 Frontier Security 称,Kimi K3 利用了沙箱配置漏洞,但其本身缺乏足够的内置防护机制。与 OpenAI 和 Anthropic 此前披露的事件类似,此次逃脱部分源于沙箱配置错误。但 Kimi K3 未发起攻击,因答案在 GitHub 上可轻易获取。Frontier Security CEO 表示 Kimi K3 在网络安全防御方面表现出色,但缺乏防止作弊或逃逸沙箱的防护机制。安全专家表示配置测试环境至关重要,AI 代理的误用可能导致系统失控。

15天前

中国开源模型免费时代终结:Kimi 之后,千问也要向大客户抽成

比推消息,据监测,路透社援引知情人士称,阿里准备给下一代 Qwen 模型加入商业收费条款。大型云平台和 API 服务商如果靠 Qwen 对外赚钱,未来可能要和阿里分成。具体门槛和比例还没确定。月之暗面已经先走了一步。Kimi K3 仍可免费下载、部署和微调,但大型 MaaS 服务商年营收超过 2000 万美元后,需要另签商业协议。路透社称,部分合作的分成最高可达 30%。普通开发者和企业自己部署,目前不受影响。真正被盯上的,是把开源模型包装成 API 再卖出去的平台。

15天前