- 月之暗面Kimi K3登顶全球开源模型榜首,因用户暴增暂停新用户订阅
- 谷歌一天发布三款新模型,同时曝光专用AI芯片Frozen v2,2028年部署
- 阿里千问3.8 Max持续进化,Qwen-Image-3.0图像模型支持4.5K超长文本
- 韩国7月芯片出口暴增180.6%,AI算力需求推动半导体创纪录增长
- Anthropic 15亿美元版权和解获批,AI训练数据合法性仍无定论
- 智谱建成1GW全国产芯片数据中心,年度经常性收入有望达10亿美元
- 五大科技巨头隐性债务达1.65万亿美元,AI投资暗藏财务风险
- 腾讯混元发布Hyra-1.0科研智能体,在29项数学问题中刷新纪录
- OpenAI前CTO穆拉蒂创业首作Inkling发布,性能不及中国开源模型
- 苹果41页诉状起诉OpenAI盗用商业机密,刻意避开前首席设计师乔纳森·伊夫

大模型竞赛:Kimi K3 登顶,千问紧追,中国模型重塑全球格局
月之暗面 Kimi K3 登顶全球开源模型榜首,暂停新用户订阅
月之暗面于7月16日发布的 Kimi K3 拥有2.8万亿参数、100万 Token 上下文窗口,在 Arena 前端代码能力榜以1679分超越 Claude Fable 5(1631分)和 GPT-5.6 Sol,登顶全球第一。这是目前全球参数规模最大的开源权重模型。
发布后用户数量远超预期,GPU 容量被打到上限,公司于7月19日宣布暂停 C 端新用户订阅,优先保障现有付费用户体验。公司 B 端业务负责人黄震昕透露,B 端收入中 API 调用占比达70%,即将上线 Kimi Hosted Agent 平台。
API 定价为每百万 Token 输入20元、输出100元(约输入3美元、输出15美元),完整权重将于7月27日向社区开放。
深度解读 & 洞察:
- Kimi K3 以四分之一于 Anthropic Fable 5 的价格实现了相近甚至部分超越的性能。但分析师指出,在复杂推理任务中 K3 消耗的 Token 数明显多于 Fable 5,Token 单价优势可能被 Token 效率差距抵消。
- 月之暗面创始人杨植麟的 CMU 博士导师 Russ Salakhutdinov 近日爆料:苹果一位直接向 Tim Cook 汇报的高级副总裁曾亲自邀请杨植麟加入,但他选择了回国创业。这个细节打破了"中国 AI 人才是被迫离开美国"的叙事。
- 马斯克在社交平台回应称其2万亿参数新模型将超越 Kimi K3,月之暗面仅回复"欢迎加入2万亿+俱乐部"。
影响:
- 对美股 AI 板块:利空。K3 发布当日美股 AI 板块集体跳水,市场担忧中国开源模型削弱美国前沿实验室的定价权。
- 对加密货币:短期中性偏空。AI 算力需求激增加剧 GPU 资源争夺,可能间接推高挖矿成本。
阿里千问 Qwen3.8 Max Preview 持续进化,前端能力再提升
阿里于7月19日上线 Qwen3.8-Max-Preview,参数规模2.4万亿(2.4T),官方称"可能是除了 Fable 5 外最强大的模型"。7月21日最新版本再度更新,前端(WebDev)能力获提升,千问大模型称"Qwen3.8 仍在每天进化"。
深度解读 & 洞察:
- 阿里采取了"预览版先行、持续迭代、正式版开源"的策略,这是一种聪明的产品信号释放方式——既展示实力,又通过真实用户反馈加速优化,还保持市场热度。
- 据《华尔街日报》评测,Qwen3.8 成绩仅次于 Anthropic 的 Fable-5,中国团队在前沿模型上紧咬不放。
- 阿里股价在 Qwen3.8 发布当天上涨5.4%,市场用真金白银投了信任票。
影响:
- 对国内 AI 产业链:利多。阿里开源策略降低了下游应用开发门槛,利好 AI 应用层企业。
OpenAI 前 CTO 穆拉蒂创业首作 Inkling:技术靠中国,价格却更贵
OpenAI 前 CTO Mira Murati 创办的 Thinking Machines Lab 于7月15日发布首款模型 Inkling:9750亿总参数,混合专家架构(MoE),每 Token 激活410亿参数,支持100万 Token 上下文,采用 Apache 2.0 开放权重。
但技术报告揭露了一个尴尬的事实:Inkling 的 MoE 设计主要沿用了 DeepSeek-V3 架构,训练阶段也依赖 Kimi K2.5 等中国开放权重模型生成的合成数据。然而性能反而没超过这些"老师"——在多项评测中均低于 Kimi K2.6 和 GLM 5.2。价格上,Inkling 预填充 Token 收费是 Kimi K2.6 的近两倍。
深度解读 & 洞察:
- 这构成了一个微妙的局面:美国 AI 创业公司用中国模型的数据训练,做出更贵但更弱的产品。美国企业可能被迫采用性能稍弱、价格更高的本土替代品,形成结构性竞争劣势。
- 硅谷分析师 Ben Thompson 对此评价:开源权重模型"免费"是假象——研发是一次性固定成本,但推理(每跑一次模型)是真金白银。中国模型看起来便宜,很大程度是因为头顶有美国前沿实验室撑起的"价格伞"。
谷歌三箭齐发:一天三模型 + 秘密芯片计划
谷歌发布 Gemini 3.6 Flash、3.5 Flash Cyber、3.5 Flash-Lite 三款新模型
谷歌于7月21日一连发布三款新模型:
- Gemini 3.6 Flash:性能最强的 Flash 版本,编程与金融任务能力提升,成本降低约17%。
- Gemini 3.5 Flash Cyber:专攻网络安全,从 V8 JavaScript 引擎中发现55个问题,包括10个此前 AI 未曾发现的漏洞。目前仅向政府机构和可信合作伙伴开放。
- Gemini 3.5 Flash-Lite:面向 AI 智能体应用场景,效率与性能平衡。
旗舰模型 Gemini 3.5 Pro 仍在测试中,原计划6月推出已延迟。谷歌透露已开始对下一代 Gemini 4 进行预训练。
深度解读 & 洞察:
- 谷歌选择在 Kimi K3 和 Qwen 3.8 冲击市场的当口密集发布,有"对冲舆论"的意味——向市场证明美国实验室仍在持续迭代。
- Flash 系列走"性价比"路线,与中国开源模型的"低价高性能"策略形成直接对抗。成本降低17%这个数字,说明谷歌正在认真对待 Token 经济学的竞争。
谷歌秘密研发 Frozen v2 专用 AI 芯片,2028年部署
谷歌正在研发代号为 Frozen v2 的定制芯片,将 Gemini 模型的部分架构直接嵌入硅片。相比现有 TPU,相同功耗下可处理6到10倍的 Token。但该芯片定位为实验性项目,不会大规模生产取代 TPU,且一旦 Gemini 底层架构改变,固化在芯片中的设计可能失效。消息公布后谷歌股价涨近4%。
深度解读 & 洞察:
- Frozen v2 本质上是"软硬件协同设计"的极致——把算法刻进硅片,用灵活性换效率。这背后是谷歌面临的现实算力压力:此前曾因算力不足拒绝外部客户,每月向 SpaceX 支付近10亿美元弥补算力缺口。
- 风险在于时间窗口:2028年还很远,而 Gemini 3.5 Pro 已经延迟,多名资深 AI 研究员流向竞争对手。谷歌需要先稳住模型迭代节奏和人才队伍。
AI 基础设施与芯片:算力军备竞赛白热化
智谱建成 1GW 全国产芯片数据中心,年收入有望达 10 亿美元
据彭博社报道,智谱已完成一座 1 吉瓦数据中心的建设,全部采用中国国产芯片。1 吉瓦电力足以为约75万户家庭供电。智谱已建成或运营多个计算集群,每个集群配备超 1 万块芯片。同时智谱近期收购了中科加禾(中科院计算所孵化的异构算力软件企业),强化国产芯片适配与算力调度能力。
智谱今年7月已提前实现全年销售额目标,年度经常性收入有望达到 10 亿美元,近期通过香港 IPO 筹集了数十亿美元。
深度解读 & 洞察:
- 这是中国 AI 公司建设最大规模服务器枢纽之一。在美国芯片出口管制背景下,智谱用行动证明了"全国产算力"路线的可行性。
- 收购中科加禾是精明的纵向整合——硬件有了,还需要编译器、运行时和推理引擎把芯片效率榨出来。AI 竞争已从"谁能训练最好的模型"转向"谁能构建最完整的自主算力体系"。
影响:
- 对国产芯片产业链:利多。智谱的大规模采购为国产 GPU 提供了"用起来"的真实场景,有助于国产芯片从"能用"走向"好用"。
五大科技巨头隐性债务达 1.65 万亿美元,AI 投资暗藏财务炸弹
日经新闻研究显示,Meta、微软、谷歌、亚马逊、苹果五大科技巨头的隐性债务(数据中心长期租赁协议 + GPU 供应合同)已达 1.65 万亿美元,比四年前增加八倍。其中 Meta 受影响最严重,隐性债务高达 4200 亿美元,接近其公开债务的三倍。
深度解读 & 洞察:
- 这些费用通过长期合同而非立即支付的方式存在,因此不被计入传统债务。但它们是真实的财务承诺,尤其当 AI 投资回报尚未被充分验证时,构成了巨大的"表外风险"。
- Gartner 预测 2026 年全球 AI 模型和平台支出将达 642.52 亿美元(增长63.4%),其中生成式 AI 模型投资增速达117%。市场在一边烧钱一边期待回报。
影响:
- 对科技股:潜在利空。如果 AI 商业化不及预期,这些隐性债务可能转化为真实的财务危机。
- 投资启示:投资者应关注科技公司财报中"不可撤销采购承诺"等表外项目。
韩国 7 月芯片出口暴增 180.6%,刷新历史纪录
韩国海关数据显示,7月前20天出口额同比增长62.9%,芯片出口同比暴增180.6%,电脑相关产品出货量增长近232%。AI 和数据中心建设热潮是核心驱动力。
影响:
- 对半导体股:利多。三星、SK 海力士等韩国芯片巨头将持续受益于 AI 算力需求。
- 对全球供应链:韩国作为全球半导体出口风向标,此数据验证了 AI 驱动的芯片超级周期仍在加速。
百时美施贵宝采购英伟达 Vera Rubin 架构超级计算系统
百时美施贵宝(BMS)成为生命科学行业首家采购英伟达 Vera Rubin 架构 DGX SuperPOD 的企业。公司表示 AI 已将药物制备时间缩短20%至30%,新系统每消耗同样电力可获得约10倍计算能力。
AI 版权与法律风暴
Anthropic 15 亿美元版权和解获批,AI 训练合法性仍无定论
美国联邦法院正式批准 Anthropic 与作家群体达成的 15 亿美元集体诉讼和解协议。约 50 万部涉案作品每部预计获赔 3000 美元,被称为美国版权法领域规模最大的和解。
关键细节:退休法官此前裁定 Anthropic 利用版权文本训练 AI 可能属于"合理使用",但同时认定 Anthropic 从 Library Genesis 等盗版网站下载了超700万本书籍属于非法获取。由于 Anthropic 选择和解而非上诉,关于"AI 训练本身是否构成侵权"的核心法律问题没有形成具有约束力的司法先例。
深度解读 & 洞察:
- Anthropic 用 15 亿美元买断了官司和不确定性。但 AI 行业最需要的是一个明确的法律信号——训练行为本身是否合法——这个信号仍然缺失。
- 对其他公司(OpenAI、谷歌、Meta、Midjourney)的类似诉讼仍在推进。Anthropic 的和解只是宏大法律博弈中的一个注脚,远非终局。
苹果 41 页诉状起诉 OpenAI 盗用商业机密,刻意避开伊夫
苹果于7月12日向加州北区联邦法院起诉 OpenAI 及其硬件子公司 io Products,指控其通过系统性挖角获取商业机密。诉状点名了前 iPhone 产品设计副总裁 Tang Tan 等多名前员工,但刻意未点名前首席设计师乔纳森·伊夫(Jony Ive)。
彭博社的古尔曼分析认为:伊夫与乔布斯遗孀关系密切(后者投资了 io Products),且若伊夫卷入诉讼,可能在法庭上引发"库克时代苹果设计地位下滑"的讨论,对苹果品牌造成伤害。
索尼音乐再次起诉 Udio:指控未经许可复制超 3 万段录音训练 AI
索尼音乐向纽约南区联邦法院再度起诉 AI 音乐公司 Udio,指控其未经授权复制超 3 万段录音用于 AI 模型训练。索尼称这仅是其识别到的数十万条侵权样本中的一小部分。Udio 此前已与环球音乐、华纳音乐达成和解。
机器人产业爆发:从实验室走向商业化
宇树科技发布人形机器人通用智能模型 UnifoLM-OminiA-0.3
搭载该模型的人形机器人 G1 展示了搬抱枕、拿药盒、整理衣物、放餐盘、调节病床等实际家居任务,能理解图像和语言指令,用户说"停"即刻停止。
智元机器人推进 IPO,目标估值约 200 亿美元
智元机器人正在推进 IPO 计划,已引入中信证券作为辅导券商,预计2026年全年收入达40亿元。WAIC 期间发布了五款新机器人产品。
三星成立机器人事业部 RX,直接向 CEO 汇报
三星电子成立机器人体验部(RX),统筹机器人中长期发展规划,推动从实验阶段走向大规模商业化。
逐际动力创始人:人形机器人大脑已达 GPT-3 阶段
逐际动力创始人张巍在 WAIC 上表示,人形机器人正处指数增长曲线,机器人大脑系统已走到 GPT-3 左右的阶段。公司已完成近 2 亿美元 Pre-IPO 融资,判断 2026 年为具身智能 PoC 验证元年。
AI 商业落地与行业应用
中国电信用大模型规划 5G 网络,效率提升 50%
中国电信将大模型引入 5G 网络规划,采用"双孪生大模型"(信道孪生 + 话务孪生)协同规划。在上海浦东的验证中,站址补点准确率超 80%,地下停车场覆盖问题识别准确率达 75% 以上。这是网络规划首次从经验驱动转变为模型驱动。
深度解读 & 洞察:
- 这件事的深层含义是:电信运营商不只是 AI 的使用者,也在变成 AI 基础设施服务商。中国电信副总经理已表态将推动经营从"传统流量经营"向"Token 经营"转型。
阿里计划推出"千问办公",整合三款智能体产品
阿里计划以 QoderWork 为核心,整合旗下 QoderWork、悟空、MuleRun 三款智能体产品,由钉钉新任 CEO 陈宇森负责。这标志着阿里在 AI 办公市场从分散布局走向统一入口。
腾讯联合 Chinagoods 推出 AI 导航,义乌采购效率提升 70%
腾讯推出"Chinagoods AI 导航"小程序,落地义乌国际商贸城(800万平方米、8万多个商位),可根据商户名称、商位号或商品信息自动规划路线,测试显示找店效率比传统方式快约 70%。还支持 AI 识物拍照匹配货源。
上海教育算力专区正式试运行,覆盖全市中小学及高校
由上海仪电牵头、三大运营商协同共建的上海首个教育专属公共算力资源池进入试运行,日均 Token 输出量超千亿级,预置 DeepSeek、GLM、MiniMax 等十余个国产大模型。
更多动态
- 腾讯混元发布 Hyra-1.0 科研智能体:可递归自我改进,在 55 个数学开放问题中刷新 29 个历史最佳,发现太阳黑子递推公式(R²=0.77),设计出含 15 个参数即可完成 10 位数加法的 Transformer。
- Sakana AI 发布 Fugu Cyber 网络安全模型:在 CyberGym 测试中成功率 86.9%,超越 GPT-5.5-Cyber 和 Claude Mythos-Preview。
- 阿里发布 Qwen-Image-3.0 图像生成模型:支持 4.5K Token 超长文本输入,12 种语言原生渲染,10px 小字也能清晰呈现,可一次生成报纸版面、试卷、分镜脚本等复杂内容。
- 阿里发布 Qwen-Audio-3.0-TTS 语音合成模型:支持自然语言指令控制语气和情绪,Flash 版首包延迟 300ms,覆盖 16 种语言和 20 种方言。
- 小鹏发布 TuringViT 高效视觉编码器:用 10% 的数据量超越主流基线,推理吞吐量为对标方案的 3 倍,支撑智能驾驶、座舱和人形机器人三大场景。
- 面壁智能发布 MiniCPM-Robot 具身智能系列模型:1.5B 参数的通用 VLA 模型,推理延迟 120ms(较 π0.5 降低近一半),已开源。
- 昆仑万维发布 Matrix-Game 3.5 世界模型:支持 720P/20FPS 实时交互,引入 Patch Memory 长期记忆机制解决物体消失变形问题。
- 谷歌 DeepMind 发布 GenCeption 多任务视觉模型:基于阿里 Wan2.1 训练,一个模型搞定深度估计、图像分割、3D 姿态估计等五项任务,仅用约 7500 段合成视频训练。
- 《第九区》导演用字节 Seedance 2.0 拍首部 AI 短片《阴兵》:13 分钟完全由 AI 生成,导演计划以相同方式拍摄长片。
- YouTube 严打低质 AI 内容:禁止三类"非真实内容"变现,包括模板化视频、制造恐惧的视频、AI 虚拟人物讨论敏感话题。
- OpenAI 扩大 ChatGPT 家长通知功能:青少年因暴力威胁或网络暴力违规被封号时,关联账号的家长会收到提醒。
- OpenAI 董事会主席预测一年后企业不再担心 Token 成本:认为 Token 管理负担将由服务商接手,收费将"以实际成果为依据"。
- CuspAI 推出 AI 材料工厂计划:NVIDIA、Meta、三星、AMD 等为创始成员,旨在加速新材料发现与合成。
- 微软考虑在 Copilot 中引入 Kimi K3:每年可节省约 6 亿美元推理成本,但面临美国政府对使用中国 AI 模型的政治审查风险。
- 申真谞受让两子 2:1 战胜围棋 AI KataGo:决胜局全程维持 99% 胜率,获 2.5 亿韩元奖金及一辆捷尼赛思轿车。
- 7-Zip 被发现高危缓冲区溢出漏洞:CVSS 评分 7.0,修复版本 26.02 已发布。
- MCP 协议将迎史上最大重构:彻底无状态化,移除 Session 与握手流程,7月28日定稿。
- 英伟达推出合成视频检测器 NIM:准确率最高 92%,1080P 视频分析最快 22 毫秒。
- 美国 AI 测试机构负责人上任仅 3 个月辞职:反映出美国 AI 政策的持续不确定性。
- 上海仪电联合 23 家产业链企业成立智算系统架构联盟:发布《超节点系统架构规范》1.0 版,覆盖从 GPU 芯片到大模型的全产业链。
- 问小白 5 Pro 上线:引入项目级记忆,支持 1.5 万字以上深度报告,所有数据可回溯来源。
- 智爱赛思推出科研专用算力 Token 方案:面向科研人员的三档 Token 套餐,整合国芯、国模与万卡算力池。
