微软发布Frontier Co.,美团开源LongCat-2.0,GitLab收购核心团队出走
- 微软发布Frontier Co.企业AI平台战略
- 美团开源万亿参数MoE模型LongCat-2.0
- GitLab收购获批,核心团队将投GitPod
微软CEO Satya Nadella正式宣布Frontier Co.,旨在帮助每个组织将其知识、工作流转化为持续自我改进的AI系统;美团在五万卡国产算力集群上训练的万亿参数MoE模型LongCat-2.0发布并开源,总参数1.6T,平均激活48B;GitLab董事会批准收购,联合创始人Dmitriy Zaporozhets及多名核心工程团队成员将在交易完成后离开公司全职投入GitPod。
title: “微软发布Frontier Co.,美团万亿模型LongCat-2.0开源,GitLab被收购” lead: “微软CEO Satya Nadella宣布Frontier Co.,帮助企业将知识转化为持续演进的AI系统;美团LongCat在国产算力上训练的1.6T参数MoE模型LongCat-2.0正式发布并开源;GitLab董事会批准被私募收购,团队将转投新公司GitPod;MCP协议通过WebMCP向网站标准扩展。” highlights:
- “微软发布Frontier Co.,企业AI平台化新战略”
- “GitLab董事会批准收购,核心团队将转投GitPod”
- “美团LongCat-2.0在5万卡国产算力集群正式发布”
1️⃣ 微软发布Frontier Co.:将企业知识转化为持续学习的AI系统#
- 核心发布:微软CEO Satya Nadella正式宣布推出Microsoft Frontier Co.,一项帮助企业构建自有AI能力的新服务。其目标是“帮助每个组织将其知识、工作流和判断转化为持续自我改进的AI系统”。
- 核心理念:Nadella将未来企业描述为“人力资本与Token资本复利的学习循环”,Frontier Co.旨在创建一个“前沿生态系统”,让组织能够持续构建和优化自有AI。
- 行业意义:这是微软迄今为止对“AI时代企业形态”最明确的战略表态,从提供模型和算力转向赋能企业成为AI原生组织,标志着企业级AI市场从“工具采购”向“能力内置”的范式转移。 🔗 Satya Nadella推文 | 微软官方博客
2️⃣ [持续跟踪] 美团LongCat-2.0正式发布与开源:在五万卡国产算力上完成训练的万亿参数模型#
- 前情提要:LongCat-2.0预览版在OpenRouter上已跻身全球调用量前三,备受开发者关注。
- 最新突破:美团LongCat团队正式发布LongCat-2.0并开源。该模型总参数1.6T,平均激活约48B,原生支持1M超长上下文,是业界首个在五万卡国产算力集群上完成全流程训练与推理的万亿参数MoE模型。
- 技术细节:采用LongCat Sparse Attention(LSA)处理1M上下文,零计算专家机制实现token级动态激活(33B~56B),MOPD多专家融合架构同时擅长代码、推理和交互。训练MFU提升1.5倍,稳态日吞吐超1T tokens/day。SWE-bench Pro 59.5,Terminal-Bench 2.1 70.8。
- 行业意义:证明了国产算力集群可以支撑万亿参数模型从训练到推理的全链路,验证了“国模国芯”的技术路线可行性。在Agentic Coding任务上已和前沿闭源模型持平。 🔗 美团技术团队博客 | LongCat体验地址
3️⃣ MCP协议生态扩展:从工具到网站,从Notion到X平台#
- WebMCP标准推进:Latent Space发布深度文章探讨“未来的网站”形态,指出WebMCP等结构化内容协议正促使网站同时为人类和AI Agent设计。Adobe首席科学家Carlos Sanchez展示“agentic sites”概念——根据用户意图实时组装个性化页面,推理成本已降至每页1-2美分。
- X平台MCP服务器:X开发者团队正式推出托管MCP服务器,支持搜索推文、发布内容、管理书签等操作,成为首个向Agent开放实时数据端口的大型社交平台。Elon Musk亲自转发。
- Notion MCP集成:Notion 3.6发布,HTML块已支持通过MCP与任意AI Agent协作,Agent可读取和编写Notion页面内容。Notion还新增了自定义Agent Action审计日志功能。
- 行业意义:MCP正从开发工具协议向互联网基础设施演进,网站和SaaS应用开始原生支持Agent交互,这可能是Web从“人类浏览器”向“混合浏览”转变的关键节点。 🔗 Latent Space文章 | X Developers公告 | Notion 3.6公告
4️⃣ [持续跟踪] Claude Fable 5全面回归后,Claude Code Artifacts向Pro/Max开放#
- 前情提要:Fable 5在美国商务部解除出口管制后于7月2日恢复全球访问,新增网络安全分类器。
- 最新进展:Claude Code的Artifacts功能现已向Pro和Max用户开放。用户可要求Claude边工作边生成实时可交互的HTML页面,页面私密且自包含。Anthropic首席产品官Mike Krieger称这是“近期最喜欢的功能之一”。
- 联网搜索恢复:Fable 5现已恢复联网搜索能力。社区实测发现,其正确回答“今天是几月几号?”但继续追问实时信息(如“今天多伦多蓝鸟队的比分?”)时表现不佳,建议用户继续使用Sonnet模式进行搜索。 🔗 ClaudeDevs公告 | Mike Krieger推文
5️⃣ GitLab董事会批准收购,核心团队将出走成立GitPod#
- 核心事件:GitLab董事会正式批准被收购。同时,投资者关系文件披露,GitLab联合创始人Dmitriy Zaporozhets及多名核心工程团队成员将在交易完成后离开公司,全职投入其云IDE项目GitPod。文件明确约定这些成员“将在交易完成前或交易完成后立即终止雇佣关系,并加入GitPod”。
- 行业意义:GitLab作为开源DevOps平台的核心资产是社区与代码库。核心工程团队的集体出走意味着收购方买到的可能主要是品牌与客户关系,而非持续创新能力,这将对GitLab的未来演进产生深远影响。 🔗 Berryxia推文 | SEC文件
6️⃣ GitHub使用秘密扫描清零2万个内部密钥的实践#
- 核心事件:GitHub Security团队分享其内部秘密扫描实践。他们在15,000+个仓库中发现了超过20,000个暴露的密钥,随后在9个月内将其清零。
- 关键策略:团队并非逐一审查,而是按仓库和密钥类型批量处理。发现90%的告警来自5个仅用于测试的仓库。通过启用推送保护、实施机器人验证及自动化工作流,系统性地完成了清理。
- 方法论价值:GitHub提炼的“检测→验证→路由→修复→自动化”五步法,以及“密钥即基础设施”的管理哲学,为规模化处理安全积压提供了成熟的可复用框架。 🔗 GitHub Blog
7️⃣ 斯坦福AI Lab发布QuasiMoTTo:用相关采样减少并行推理计算浪费#
- 核心发布:斯坦福AI Lab发布QuasiMoTTo,一种利用相关样本替代独立并行采样以提升推理效率的新方法。
- 核心思想:独立采样并行尝试时会浪费算力重复发现相同解决方案。QuasiMoTTo通过生成相关样本,具有更高覆盖率且可并行生成,在测试时扩展中减少25-47%的采样数,在RL训练中减少50%的训练步数。
- 行业意义:在推理计算成本持续高企的背景下,QuasiMoTTo直接挑战了当前“独立采样越多越好”的默认做法,提供了一条更经济的推理扩展路径。 🔗 Stanford AI Lab推文 | 论文链接
8️⃣ Gumroad创始人:一个AI Agent处理了99.98%的业务#
- 核心事件:Gumroad创始人Sahil Lavingia在X平台发文称,“One agent runs 99.98% of Gumroad”。这条推文引发社区对代码代理化与商业闭环的广泛讨论。
- 行业意义:这提供了AI Agent从辅助工具到完整业务执行者的真实运营数据支撑,展示了当Agent深度嵌入核心业务流程后,人类角色的转变。 🔗 Sahil Lavingia推文
9️⃣ 字节跳动发布EdgeBench:揭示Agent从真实环境学习的Scaling Law#
- 核心发布:字节跳动Seed团队发布EdgeBench,一个研究Agent从真实环境中学习能力的基准。包含134个真实世界任务,每个任务支持12-72小时的Agent工作。
- 关键发现:经过38,000小时的Agent运行,发现性能与环境交互时间之间存在高精度的log-sigmoid函数关系,可用图探索理论解释。这是首个从真实实验数据中验证的Agent学习规模定律。
- 行业意义:EdgeBench为理解Agent的“学习曲线”提供了科学基础,验证了交互时间对Agent能力增长的关键作用,对资源分配、训练策略设计具有直接指导意义。 🔗 Deyao Zhu推文 | EdgeBench主页
🔟 小米12篇论文入选ECCV 2026#
- 核心事件:小米技术团队公布12篇论文被ECCV 2026接收,覆盖人脸视频修复、流式视频推理、GUI Agent、自动驾驶世界模型等方向。
- 亮点成果:TIGER框架实现单步推理修复退化人脸视频;VST提出“边看边想”的流式视频理解范式,响应速度提升15.7倍;DriveVA验证了大规模视频生成先验在自动驾驶泛化规划中的有效性。
- 行业意义:展示了大型终端公司在计算机视觉全栈——从基础视觉理解到具身智能应用——的系统性技术积累。 🔗 小米技术博客
⭐ GitHub 趋势#
📊 类别速览
| 项目 | 类别 | Stars |
|---|---|---|
| JuliusBrussee/caveman | Agent 工具 | 80.8k |
| ChromeDevTools/chrome-devtools-mcp | MCP 服务器 | 45.1k |
| openai/codex-plugin-cc | 跨 Agent 协作 | 22.6k |
1. JuliusBrussee/caveman ⭐ 今日 +926#
语言/许可: JavaScript / MIT
总 Stars: 80.8k
仓库: GitHub
项目定位:
面向所有 LLM Agent 用户的输出 token 压缩工具,通过 prompt 工程将 agent 回复风格改为电报式,平均减少 65% 输出 token,保留技术准确性。
核心功能:
- 支持
/caveman [lite|full|ultra|wenyan]多级压缩,wenyan 为文言文模式(进一步压缩) - 内置
caveman-compress用于压缩 CLAUDE.md 等记忆文件,减少每次会话的上下文开销 caveman-stats实时统计 token 节省量并写入状态栏- 通过 skill 文件安装,兼容 Claude Code、Codex、Cursor、Windsurf、Cline 等 30+ Agent 平台
技术亮点:
多层 prompt 工程(三级压缩 + 文言文)配合 MCP 中间件实现跨 Agent 统一 token 裁剪;带基准测试套件和独立评估框架(evals/)。
2. ChromeDevTools/chrome-devtools-mcp ⭐ 今日 +104#
语言/许可: TypeScript / Apache-2.0
总 Stars: 45.1k
仓库: GitHub
项目定位:
将 Chrome DevTools 功能封装为 MCP 服务器,使 coding agent 能直接控制浏览器进行自动化、调试和性能分析,解决 agent 无法可靠操作浏览器的问题。
核心功能:
- 性能分析:录制 trace 并提取性能优化建议,可结合 CrUX 获取真实用户数据
- 浏览器调试:分析网络请求、截取屏幕、检查控制台消息(带 sourcemap 堆栈)
- 基于 Puppeteer 的可靠自动化,自动等待操作结果
- 提供
--slim模式减少工具暴露面,支持 headless 运行
技术亮点:
Google 官方维护,通过 MCP 协议将 DevTools 能力暴露给任意 MCP 客户端;数据收集与隐私分离(提供 --no-usage-statistics 选项)。
3. openai/codex-plugin-cc ⭐ 今日 +352#
语言/许可: JavaScript / Apache-2.0
总 Stars: 22.6k
仓库: GitHub
项目定位:
为 Claude Code 用户提供直接调用 Codex 能力的插件,实现多 Agent 间的任务委托、代码审查与会话迁移,减少模型切换成本。
核心功能:
/codex:review和/codex:adversarial-review:在 Claude Code 内发起 Codex 审查(支持分支对比、背景运行)/codex:rescue和/codex:transfer:将调试/实现任务委托给 Codex,或把当前会话上下文迁移到 Codex CLI 中继续--review-gate:在 Claude 输出前自动触发 Codex 审查,发现问题时阻止输出- 插件可感知项目级 Codex 配置(model、reasoning_effort)
技术亮点:
OpenAI 官方实验性项目,利用 Claude Code 的插件系统实现跨模型工作流,提供了 Stop hook 实现审查门控;session 迁移机制保留完整上下文。
🟧 Hacker News 热议#
Claude-real-video - any LLM can watch a video#
67 pts · 18 comments · github.com/huangchihhungleo
📌 内容总结
- 作者解决了 LLM 无法真正“看”视频的问题:Claude 不接受视频文件,ChatGPT 只读字幕,Gemini 按固定间隔(默认 1fps)采样帧,会错过快速切换的场景并对静态画面过度采样。
- 工具采用场景变化检测 + 滑动窗口去重 + Whisper 转录,输出帧和文本,本地运行(MIT 协议)。
- 10 分钟演示视频从约 600 帧压缩至 5-15 帧,实现 90%+ 的 token 节省,同时提升模型理解质量。
💬 讨论总结
- 共识:项目思路清晰,解决了普遍痛点。多位开发者表示自己做过类似尝试,并认可场景检测 + 去重的设计方向。
- 关键争议点 1:名称误导。多个评论指出“claude-real-video”暗示该工具只适用于 Claude,但实际可搭配任何 LLM 使用。建议改名为“llm-real-video”或“llm video preprocessor”。
- 关键争议点 2:帧≠视频。有评论指出关键帧序列无法捕获运动过程、对象持续存在等信息,LLM 无法像人类理解视频一样理解帧序列。这一观点未受到明显反驳。
- 反对意见:成本与效率。有经验者认为用 Claude 分析视频成本过高,推荐使用 Gemini 或本地 VLM 搭配更高效的视频编码方案(如 vlm-run)。这一观点未引发进一步讨论。
- 附加工程经验:针对运动设计场景,将帧排列成网格图像让模型查看效果尚可,但会丢失细节;尝试视觉嵌入、运动热力图等方法均不如直接文字描述准确。
- 用户体验反馈:有用户用该工具处理车速罚单录像,Claude 分析结果准确,但对 Claude 是否真的无法处理视频提出疑问。
Launch HN: Manufact (YC S25) – MCP Cloud#
97 pts · 61 comments · manufact.com
📌 内容总结
- 作者想做什么:提供一个 MCP(Model Context Protocol)的全栈开发、部署和运维平台,对标“Vercel for MCP”。
- 解决的问题:
- 简化 MCP Server 和 MCP App 的构建流程(
npx create-mcp-use-app脚手架) - 自动化部署(Git push 触发,分支预览)
- 内置监控、日志、会话回放、市场提交清单
- 简化 MCP Server 和 MCP App 的构建流程(
- 技术实现:开源 SDK(mcp-use) + 托管平台,支持 ChatGPT、Claude、Gemini、Cursor、Copilot 等客户端。
- 用户反馈焦点:产品定位清晰,但定价、认证、市场价值表述模糊。
💬 讨论总结
- 共识:MCP 定位被过度抬升。多位评论者认为 MCP 只是一个协议(类比 REST/SOAP),不是产品本身。MCP 的价值在于组织工具、简化分发和认证(如 OAuth),并非万能解决方案。
- 工程经验:MCP vs CLI。有经验的开发者指出:
- CLI 对编码 agent 更友好,但需要执行环境;MCP 在 chat 客户端和远程服务场景更合适。
- MCP 对较弱模型(较便宜)更友好,因为工具描述被预注入。
- MCP 的核心便利是将工具描述自动注入,同时需要警惕上下文膨胀。
- 商业现实:定价与认证问题。用户指出:
- 定价页面“credits”含义不透明,需要更清晰的按量计费说明。
- MCP 的认证(OAuth/scopes)仍是关键痛点,如
offline_access导致频繁重新认证的问题(Codex bug 示例)。 - 有潜在客户指出,先注册才能浏览 MCP 列表的做法阻碍了体验。
- 反对意见:“MCP 是死路,CLI 才是未来”。这一观点被多人反驳:CLI 在无执行环境或安全性要求较高的场景不实用。
- 产品与市场需求:多位用户提到已使用 Manufact 数月,而另一部分用户则无法理解产品实际价值。团队需更清晰地说明“没有预构建的 MCP 集合”和“平台需要部署后使用”的约束。
- 认证方案参考:团队在回复中提供了 auth 模板和博客链接(OAuth MCP、authentication),并预告 v2 将内置对 buggy client 的处理。
Show HN: CLI that helps AI agents avoid vulnerable dependencies#
7 pts · 0 comments · github.com/clidey
📌 内容总结
- 背景 / 作者意图:AI agent 会经常推荐过时的、包含已知漏洞的第三方依赖,作者为此开发了 deptrust 来解决这个痛点。
- 关键要点:
- 支持 14+ 个包管理器/生态系统(npm、PyPI、crates.io、Go modules、RubyGems、NuGet、Maven、GitHub Actions 等)。
- 查询 OSV 和 GitHub Advisory Database,在本地运行(CLI 或 MCP server),无需中心化服务。
- 输出 recommendation(block、review、allow),并附带风险分数、检查 provider 覆盖状态等详细 JSON 信息。
- 实际结论 / 限制 / 限制:
allow表示在公开数据源中未发现已知漏洞,并不证明该包绝对安全;还提供了“72小时内发布”等非 CVE 风险信号。
💬 讨论总结
- 社区暂无公开讨论。投稿可能仍处于早期上线阶段,未被 HN 社区广泛浏览。
- 从工具设计上看,它补充了当前 AI agent 工具链中的缺失环节——依赖安全审计。如果与 Codex、Claude Code 等 agent 集成,可以强制在引入或更新依赖前进行检查,有望在 agent 生态中获得价值。
今日洞察#
今日多个信号指向同一个趋势:Agent的边际效率提升正在从模型能力转向工程优化,token成本和推理策略成为新的约束边界。caveman以80k stars成为GitHub今日增长最快项目,核心功能是通过prompt工程减少65%输出token——开发者主动裁剪Agent输出,说明token成本已从“忽略不计”变为“必须管理”的变量。同一逻辑下,斯坦福QuasiMoTTo用相关采样替代独立并行推理,减少25-47%的采样数,挑战了“采样越多越好”的默认做法。EdgeBench用38,000小时Agent运行数据验证了性能与交互时间之间的log-sigmoid关系,暗示更长交互并非线性有效,存在收益递减拐点。
这些优化不是孤立补丁,而是系统方案。Chrome DevTools MCP将浏览器调试标准化为Agent能力,减少手动操作;视频帧工具claude-real-video用场景检测将600帧压缩至5-15帧,同时提升理解质量。它们共同指向一个二阶影响:模型公司的高价API模式面临压力。当开发者可以轻易裁减65%输出token时,按token计费的商业模型会被工程手段对冲,低成本替代(如本地模型、低秩推理)会加速渗透。另一个可能是,Agent平台化工具(如Manufact的MCP Cloud)将在成本控制上竞争,而不是堆叠模型能力。
GitLab核心团队出走的信号同样值得注意:收购方买到的可能是品牌与客户关系,而非持续创新能力。这对企业级开源软件市场是一个警示——社区治理结构比代码库更难复制。
title: “Claude Fable 5 能力削弱,可灵独立融资 30 亿美元,Anthropic 启动造芯” lead: “第三方测试显示 Claude Fable 5 重新部署后因安全护栏过严,调试能力暴跌 70%;快手旗下的可灵 AI 独立融资 30 亿美元,投后估值 180 亿元;Anthropic 被曝启动自研 AI 推理芯片并正与三星讨论 2nm 工艺制造。” highlights:
- “可灵 AI 独立融资 30 亿美元,投后估值 180 亿元”
- “Anthropic 被曝启动自研 AI 推理芯片,正与三星谈判 2nm 工艺”
- “Meta 宣布搭建云计算业务出售算力,引发半导体板块暴跌”
1️⃣ [持续跟踪] Claude Fable 5 回归后争议不断:安全护栏致性能“腰斩”#
- 前情提要:Anthropic 于昨日在美国商务部解除出口管制后恢复 Fable 5 的全球访问,并新增网络安全分类器。
- 最新突破:第三方测试平台 BridgeMind 重新在 BridgeBench 上测试最新版 Fable 5,发现其能力大幅下降。Debugging 得分从 86.2 暴跌至 25.9(降幅 70%),Refactoring 从 73.6 降至 38.4(降幅 48%),Hallucination 从 75.9 降至 61.7。分析指出,新的安全护栏在大量任务中过度触发,导致请求被回退到能力较弱的 Opus 4.8。
- 社区反响:用户抱怨“花了 Fable 5 的两倍价格,实际上用的是 Opus 4.8 的能力”。与此同时,Arena 官方发布预览数据,证实在 Text、Vision 等多项 Arena 中,重新部署后的 Fable 5 分数与之前基本一致,唯独 Frontend 一项下降约 20 分。
- 行业意义:这暴露了安全对齐与模型性能之间的尖锐矛盾。强行增加安全护栏可能会严重损害模型在特定任务上的能力,Anthropic 需要在高安全性与用户期望的性能之间找到更精确的平衡点。 🔗 BridgeMind 原始测试 | Arena 分数预览
2️⃣ Anthropic 启动自研 AI 芯片,正与三星洽谈 2nm 工艺#
- 核心事件:据 The Information 援引多位知情人士消息,Anthropic 已启动自研 AI 芯片的早期工作,正与三星电子讨论使用其最先进的 2nm 工艺和封装技术来制造该芯片。芯片将重点聚焦推理场景。
- 战略背景:Anthropic 是目前最后一家完全依赖外部芯片的主要 AI 实验室。此举旨在控制不断飙升的推理成本并确保算力自主,构建“模型+芯片”的闭环。其 CEO Dario Amodei 曾表示,算力扩张决策是“平衡增长与破产的赌博”。
- 关键人才:Anthropic 已于 6 月 9 日挖来了 OpenAI 定制芯片团队的早期成员 Clive Chan,为自研芯片团队铺垫。
- 行业意义:这将进一步加剧 AI 芯片领域的军备竞赛,标志着上游硬件自研正成为前沿模型公司的标准动作。同时,三星若能拿下此单,将对其追赶台积电的代工业务意义重大。 🔗 腾讯科技报道
3️⃣ 可灵 AI 独立融资 30 亿美元,跻身全球 AI 视频赛道估值第一#
- 核心事件:快手旗下视频生成大模型可灵 AI 宣布完成独立融资,初始融资金额约 138 亿元人民币,并获 15 家外部投资方追加,认购总上限锁定 204.47 亿元(约 30 亿美元)。投后估值达 180 亿美元,创下全球 AI 视频生成公司单轮融资及估值的最高纪录。
- 投资方阵容:腾讯、阿里云、百度三大互联网巨头罕见同时下注,此外 CPE 源峰、北京人工智能产业基金、红杉中国、华策影视等 30 余家机构参与。
- 商业数据:可灵 2025 年全年收入约 11 亿元人民币,2026 年 3 月年化运行收入已跃升至 5 亿美元。CEO 盖坤获得 3% 个人股权激励,治理结构采用同股不同权安排。
- 行业意义:这标志着 AI 视频赛道从技术概念验证进入独立商业化运营阶段。快手通过分拆释放了这块高增长资产的价值,可灵在手握 30 亿美元弹药后,将与字节 Seedance 在全球市场展开激烈竞争。 🔗 极客公园报道
4️⃣ Google 发布 Nano Banana 2 Lite 与 Gemini Omni Flash:拉低媒体模型生成成本#
- 核心发布:Google 正式发布两款新的 Gemini 媒体模型:图像生成模型 Nano Banana 2 Lite 和视频生成/编辑模型 Gemini Omni Flash。两者均已在 Gemini 应用和 API 中可用。
- Nano Banana 2 Lite:专为高吞吐量设计,可在 4 秒内生成一张 1K 分辨率图片,定价约为 1 美元 30 张,极具成本竞争力。在 LMSys Text-to-Image Arena 排名第五。
- Gemini Omni Flash:一个原生多模态视频生成和编辑模型,支持对话式编辑,定价为 0.10 美元/秒。该模型在 LMSys Video Edit Arena 中排名第二。Runway 等已宣布集成。
- 行业意义:Google 针对不同市场层次,用低成本、高效率的模型组合,进一步打薄了 AI 媒体生成的价格壁垒,这对需要规模化内容生产的广告、短剧、电商行业影响深远。 🔗 Google 官方博客 | 向阳乔木解读
5️⃣ Meta 官宣出售算力,引发半导体及存储板块集体暴跌#
- 核心事件:Meta 被曝正在搭建一项云基础设施业务,计划将内部过剩的 AI 计算能力(涵盖算力及 Llama 模型使用权)出售给外部客户以获取收入。扎克伯格此前在股东会上表示,这是为巨额算力投资“买保险”。
- 市场反应:消息发布后,Meta 股价逆势上涨 8.81%。但市场担忧科技巨头算力军备竞赛降温,导致费城半导体指数重挫超 6%,美光、闪迪暴跌超 10%,英特尔、AMD、台积电等跌幅超 5%。独立云计算商 CoreWeave、Nebius 跌幅超 13%。
- 行业解读:市场将此视为 AI 基础设施投资可能过热的早期预警信号。当最大的算力买家开始准备做卖家,说明供需关系或许不再像之前预估的那样紧张,进而动摇了整个算力租赁和存储产业链的高增长叙事。 🔗 创业邦/Meta云计算深度分析
6️⃣ Anthropic 推出 Claude Science:专为科研设计的工作台#
- 核心发布:Anthropic 正式推出面向科研全流程的应用 Claude Science,目前已开启 Beta 测试。客户端支持 Mac(M 及 Intel 芯片)和 Linux。
- 关键功能:支持通过代码绘制图表、运行环境可按需管理、研究产出可追溯到对应代码,并可连接 60 多个可选科学数据库(如 UniProt、PDB 等)。该产品定位为“AI 工作台”,而非简单的聊天界面。
- 行业意义:继 Claude Code 之后,Anthropic 再次切入垂直领域,将模型能力打包为行业专用“操作层”。这表明 AI 巨头正从卖通用模型转向卖深度绑定行业工作流的解决方案,能更有效地捕获特定领域的价值。 🔗 Anthropic 官方博客 | 下载地址
7️⃣ Palantir CEO 开火:抨击 OpenAI 和 Anthropic 的 Token 计费模式#
- 核心事件:Palantir CEO Alex Karp 在接受 CNBC 专访时,向 OpenAI 和 Anthropic 的 Token 计费模式发起了猛烈抨击。他直言企业正在为“不产生价值的 Token 付费”,并指责这些实验室通过推理过程“偷走我业务的权重和 alpha”。
- 核心观点:Karp 认为,如果模型真能创造巨大价值,公司应该选择利润分成或股权,而不是按 Token 收费。Token 定价本身就是“产品无法大规模可靠创造价值”的坦白。他警告,企业数据通过 API 喂给模型,可能让实验室学会“如何取代你的公司”。
- 行业意义:这不仅是一场商业模式的争论,更触及企业 AI 应用中的数据主权与价值分配问题。Palantir 作为与这些实验室存在直接竞争关系的公司,其攻击立场鲜明,但提出的“价值定价”与“数据安全”问题,值得所有大型企业客户深思。 🔗 Karp 完整言论 | AI Will 解读
8️⃣ 阿里巴巴全面禁用 Claude Code:源自“隐形水印”事件#
- 核心事件:由于 Claude Code 此前被曝出在系统提示中通过不可见 Unicode 字符标记用户代理信息,涉嫌针对中国用户和特定实验室进行检测,阿里巴巴宣布内部全面禁用 Anthropic 全系工具,包括 Sonnet、Opus、Fable 各版本模型以及 Claude Code。
- 行业影响:这一事件加剧了 AI 开发工具信任度的危机。对于 Anthropic 来说,如何修复与大型企业客户,特别是跨国客户之间的信任裂痕,将是一个严峻挑战。 🔗 小互爆料
9️⃣ Hugging Face 与 Cerebras 联合发布开源实时语音系统#
- 核心发布:Hugging Face CEO Thomas Wolf 联合 Cerebras 发布了一个完全开源的实时语音交互演示,包含模型和代码。用户可在线测试、复刻并修改该系统。Wolf 表示,开源语音到语音(speech-to-speech)技术的状态值得所有人更新他们的认知。
- 行业意义:这直接将高质量的实时语音交互能力开放给整个开发者社区。在 xAI 等巨头发布商业语音 Agent 的同时,开源社区提供了一个可自建、可控制的替代方案,极大降低了相关应用的门槛。 🔗 Thomas Wolf 推文 | Demo 链接
🔟 Vercel 首席软件官:Agent 是新型软件,Vercel 正转变为 Agent#
- 核心观点:Vercel 首席软件官 Andrew Qu 在接受 Latent Space 采访时表示,Agent 是一种新型软件,其交互与输出比传统 Web 应用更动态。他强调,未来的 Web 将需要同时为人类和 Agent 提供服务,Vercel 平台本身正在成为一个 Agent。
- 关键洞察:Qu 提出,成功的关键在于“上下文比提示更重要”,并分享了开发 Agent 时应从“定义代码”演进到“定义目标”的方法论。他还介绍了 Vercel 内部用于构建 Agent 的框架 eve。
- 行业意义:这代表了顶级平台公司对 AI 原生时代的明确战略转向。当平台自身变成 Agent,整个开发者生态的基础设施、接口设计和商业模式都有可能发生根本性变革。 🔗 Latent Space 文章