agent · 1397

Arthur Hayes 提醒:FLOP 尚未发行,不存在预售或 Meme 币

比推消息,BitMEX 联合创始人 Arthur Hayes 发文提醒称,Flop Labs 目前尚未发行 FLOP 代币,也不存在预售或 Meme 币。Hayes 表示,FLOP 目前尚未正式上线,并提醒社区不要将市场上出现的相关代币误认为官方资产。他称,Flop Labs 预计将在未来几个月启动空投,并计划于明年推出主网。此前公开信息显示,该项目此前曾计划于 2026 年第四季度进行大规模空投,主网创世区块目标时间为 2027 年第一季度。Hayes 此前曾宣布将领导 Flop Labs,该项目旨在构建面向 AI Agent 的经济基础设施,FLOP 将被设计为 AI Agent 支付算力、存储等资源的原生资产。

3小时前

腾讯芯片负责人高剑林离职创业,瞄准 RISC-V 高性能 AI CPU 赛道

比推消息,据 MaxForAI 披露,腾讯芯片研发核心负责人高剑林近期已离开腾讯并开启创业,计划围绕高性能 AI 服务器和 Agentic AI(智能体 AI)方向,研发基于 RISC-V 架构的高性能 CPU。高剑林被认为是腾讯自研芯片体系早期核心推动者之一。资料显示,他于 2013 年在腾讯内部组建 FPGA 硬件团队,2018 年开始布局 AI 芯片研发,2020 年成立蓬莱实验室,并推动腾讯多款 AI 芯片研发及数据中心部署。此次创业方向聚焦 CPU,而非当前竞争激烈的 AI GPU 市场。报道称,高剑林认为,随着 Agentic AI 快速发展,AI 推理过程将涉及模型调用、工具执行、搜索、数据库交互以及大量任务调度,CPU 将在 AI 系统中承担更加重要的调度和控制角色。据报道,高剑林此前在腾讯期间已涉及 RISC-V 相关研发,并参与芯片架构、验证、后端等多个技术方向。其新公司计划基于开放指令集 RISC-V 打造高性能服务器 CPU,以切入 AI 基础设施市场。目前,高剑林新公司名称、融资情况及具体产品发布时间尚未公开。市场关注其是否会成为中国 AI 芯片领域又一家瞄准服务器 CPU 和智能体基础设施的新兴力量。

5小时前

谷歌给 Antigravity 装上遥控器:手机直接接管本地 Agent

比推消息, AI 快讯,Google 给 Antigravity 2.0 上线远程控制功能。电脑上的 Agent 还在干活时,人可以直接离开桌面,用手机或其他设备的浏览器继续控制。无需安装单独的手机 App。远程端可以查看正在运行的会话、继续发任务、检查方案和产物。用户还能同时连接笔记本、台式机和服务器,在不同机器之间切换。手机端还可以开启推送,Agent 做完一轮或需要人工确认时会主动提醒。Google 还支持把服务器接进远程控制。即使没有图形界面,也可以在服务器上持续跑 Agent,再用手机或浏览器远程管理。功能目前正在分批开放,Google AI Ultra 用户优先。

5小时前

智谱又送 1 亿 Token:这次备了 5 万份,上轮曾挤停

比推消息, AI 快讯,智谱又给 ZCode 新用户发 GLM-5.3 免费额度。北京时间 8 月 22 日 0 点到 24 日 9 点,首次登录 ZCode 的新用户可自动领取 1 亿 Token,共 5 万份,先到先得。额度只能在 ZCode 内使用,活动结束后没用完的直接失效。这已经是同一活动第二轮。上一轮 8 月 16 日开启后,ZCode 很快就因为需求超过服务容量,暂停继续发放 1 亿 Token。几天后活动重新开跑,这次官方直接把名额写明为 5 万份。1 亿看着很多,但 Agent 编程也很能吃 Token。跑重度长任务的话,1 亿 Token 几小时就能耗完。GLM-5.3 API 目前也已经开放,但这波免费额度仍是 ZCode 专属,不能当普通 API 余额使用。

7小时前

小米 MiMo 系列模型正式登陆 B.AI API

比推消息,B.AI 平台宣布小米自研 MiMo 系列模型正式上线 API 服务,首批开放 MiMo-V2.5 与 MiMo-V2.5-Pro 两款模型。 其中 MiMo-V2.5 为 310B 稀疏 MoE 原生全模态模型,支持图文音视频全模态输入与 1M 超长上下文,专为多模态 Agent 与通用编程场景打造;MiMo-V2.5-Pro 则达到 1.02T 稀疏 MoE 参数规模,定位旗舰文本模型,主攻复杂推理与长周期软件工程,SWE-Bench Verified 基准测试取得 78.9 分的高分表现。 即日起,开发者可通过 B.AI API 调用两款模型,支持官方组接入与自选服务商双重模式,并享低至 4 折优惠。

23小时前

DeepSeek 视觉模型多模态 Agent 能力逼近 Opus 4.8,4 项打成 2:2

比推消息,DeepSeek 公布 V4-Flash-Vision-Exp 首批 Agent 跑分。在 4 项多模态 Agent 评测中与 Opus 4.8 打成 2 胜 2 负:Agents' Last Exam 27.3 对 25.7,ZeroBench 35.0 对 34.0;ApexBench 36.5 对 39.4,Chartography 64.3 对 65.0。相比纯文本版 V4-Flash-0731,视觉版在 ApexBench 从 26.2 升至 36.5,Agents' Last Exam 从 25.2 升至 27.3。官方注明纯文本版会忽略多模态内容,故主要体现补上视觉输入后的能力。加上视觉后文本 Agent 能力未明显缩水,7 项文本评测中 6 项高于 V4-Flash-0731,如 DeepSWE 从 54.4 升至 59.3(超 Opus 4.8 的 58.0),Toolathlon 75.9 几乎追平 Opus 4.8 的 76.2。该结果来自 DeepSeek 官方自测,非第三方独立榜单;公开 Code Agent 文本任务使用 DeepSeek Harness 极简模式,推理档位为 max。

1天前

小米 MiMo-V3-Pro 跑分疑似泄露,SWE-Bench Pro 达 72.8 或逼近海外顶尖闭源模型

比推消息,Max For AI 发文披露,一张疑似小米下一代大模型 MiMo-V3-Pro 的 Benchmark 截图在社群中流传。截图显示,该模型重点瞄准 Coding Agent 和通用 Agent 场景,部分测试成绩已接近 Claude Opus、GPT 等海外顶尖模型。据疑似截图,MiMo-V3-Pro 在 SWE-Bench Pro 上取得 72.8 分,高于 GLM 5.3 的 67.9 分和 Kimi K3 的 65.8 分,与 Claude Opus 5 的 74.6 分、GPT-5.6 Sol Max 的 75.4 分相差不到 3 分;Terminal-Bench 2.0 得分 70.6 分,同样接近 Claude Opus 5 的 72.0 分和 GPT-5.6 Sol Max 的 73.5 分。此外,其τ3-bench 得分达到 76.4 分,而 GPT-5.6 Sol Max 为 78.8 分。若上述成绩最终经官方确认并能在正式版本中复现,MiMo-V3-Pro 或将进入全球顶尖模型第一梯队。不过,目前该 Benchmark 截图的真实性及测试条件尚未得到小米官方确认,相关数据仍应视为未经证实的爆料。值得注意的是,小米目前官方公开的最新 MiMo 旗舰为 MiMo-V2-Pro 及 MiMo-V2.5-Pro,因此 V3-Pro 是否存在以及具体发布时间仍有待官方进一步披露。

1天前

Fortune Protocol 宣布完成多轮融资,累计融资金额超 400 万美元

比推消息,AI+预测市场项目 Protocol 官方披露最新融资信息。项目此前已完成 Seed 轮及 Pre-A 轮等多轮融资,累计融资金额超 400 万美元。据悉,参投机构包括 K24 Ventures、CGV FoF、MH Ventures、Mapleblock Capital 等。 Protocol 表示,本轮资金将主要用于推动 AI Agent 的技术升级、预测市场流动性的集成与扩展以及生态建设。随着 TGE 的临近, Protocol 致力于构建面向下一代预测市场的智能化基础设施,推动行业向更加智能、高效与开放的方向发展。

1天前#融资

AllScale 上线 CLI 工具,AI Agent 可一键完成稳定币收付款

比推消息,据自托管稳定币数字银行 AllScale 官方 X 账号,该平台上线 AllScale CLI 命令行工具,一次安装即可在终端完成稳定币收款、付款与账目核对。收款端,一条命令即可向任意有效邮箱发送明细发票,支持 USDT 或 USDC,收款方无需事先注册或建立合作关系。付款端,用户只需一次性批准支出限额,包括单笔上限、总预算及有效期,此后脚本可无人值守运行。每次付款会创建并注资一条 Claim Link,收款方无需提供钱包地址;该流程具备幂等性,中途失败的任务不会重复打款。每条命令向标准输出打印 JSON,并返回 13 种已文档化的退出码,脚本或 AI Agent 可据此自动分支处理结果,无需截图核对页面。AllScale 表示,只要能运行 shell 的环境即可使用该 CLI,现已上线 npm,包名为 @allscale/cli。

1天前
唱衰Anthropic的人,可能要失望了

唱衰Anthropic的人,可能要失望了

作者:硅谷Alan Walker 原标题:Anthropic的增长放缓了吗争议的源头。TickerTrends 制作的 Claude Code ARR 追踪图,最新数据为 2026 年 8 月 10 日当周,151.2 亿美元,占 Anthropic 总 ARR 的 21.9%。请注意:这是第三方机构的估算,不是 Anthropic 的官方披露。下面第一节会讲清楚这个区别有多重要。硅谷 Alan Walker 在香港约了顿晚饭,等人的功夫翻群,发现这张图已经被转了三十几次,配的话大同小异——「Anthropic 增长拉平 了,两万亿是泡沫」。Alan 把图存下来,放大看了一遍,然后又看了一遍。问题不在这张图。这张图做得很好,数据也大概率是认真做的。问题在于,几乎所有转发它的人,都在用它回答一个它根本回答不了的问题。01先搞清楚这张图是谁做的左上角有个 Claude 的图标,配色是 Claude 那个熟悉的橙色,一眼看过去很像官方出品。它不是。这张图的作者是 TickerTrends,右上角写着自己的名字。它是一家 第三方数据追踪机构,靠各种外部信号(应用数据、支付面板、招聘、渠道口径等等)去估算一家非上市公司的收入。图里那行小字写得很老实:「tracked allocation」——追踪出来的分配比例。说白了:Anthropic 从来没有公开披露过 Claude Code 单独的 ARR 数字,一次都没有。这条曲线上的每一个点,都是 外人估的。举个例子这就好比有人用「某餐厅门口每天排多长队」来估算它的营业额,然后画出一条漂亮的周度曲线。队伍长度和营业额确实相关,但中间隔着翻台率、客单价、外卖占比、包厢生意——你看到队伍短了三周,可能是那三周厨房在装修。更要命的是口径本身。ARR 的算法是「最近一段时间的收入 × 12」。企业软件的合同不是每天均匀落地的,是一批一批签的。一个季度末签下的大单,会让某一周的曲线跳一大截;下一个季度的大单还没签,曲线就横着走。周度 ARR 追踪对这种块状落地极不敏感——它会把「签约节奏」画成「需求变化」。一句话解读你手里拿的是一张外人估的、口径很钝的、非官方的周度图。用它下"泡沫"这么重的判断,等于用体温计量血压。02这张图自己就打了自己的脸接下来这一点,没见有人提过,但它是整件事里最有意思的地方。图上写着两个数:Claude Code 是 151.2 亿美元,占 Anthropic 总 ARR 的 21.9%。做个除法:算一下151.2 亿 ÷ 21.9% = 约 690 亿美元这是这张图自己隐含的、截至 8 月 10 日当周的 Anthropic 公司总 ARR。而 Bloomberg、Reuters、CNBC 在 8 月 17 日报道的官方口径数字是——7 月底 650 亿美元。看清楚了:这张被拿来论证"增长放缓"的图,它自己隐含的公司总量,比十天前的官方数字还高出 40 亿美元。再往后推十天到今天,如果趋势没断,700 亿以上 是合理的推算(这一句是推断,不是数据)。一句话解读转发的人只读了 151.2 这个数和柱子的高度,跳过了旁边那个 21.9%。而那个 21.9% 说的是:这家公司在大家喊"它慢下来了"的时候,又往上走了一截。同一张图上的两个数,只信对自己观点有利的那个,这不叫分析。03你在看下面那张图,钱在上面那张图里那张图有上下两块。上面是绝对金额(多少亿美元),下面是百分比变化(比四周前涨了百分之多少)。绝大多数人的推理是:在下面...

1天前Wendy#Anthropic #ARR #IPO #MiniMax