← 返回首页

AI 行业日报

2026-08-15 · 共扫描 10 个信息源,收录 36 篇今日文章

今日要点

模型发布与更新

阿里开源Qwen3.8-27B,性能大幅提升

阿里开源Qwen3.8-27B模型,支持262K上下文,可外推至1M,编程和办公性能大幅提升,以Apache2.0协议开放,可免费商用。该模型在多个基准测试中表现优异,适合家用显卡运行。

量子位 要点
  • Qwen3.8-27B开源,支持262K原生上下文,可外推至1M
  • 编程和办公性能提升,超越Qwen3.7-Plus
  • Apache2.0协议,免费下载部署及商用

Z.ai发布GLM-5.3,提升复杂编码能力

Z.ai发布GLM-5.3模型,基于GLM-5.2的743B基座模型,通过扩展后训练提升编码和网络安全能力,但权重暂未公开。该模型在编码任务上表现接近Fable 5,并修复了潜伏40年的bug。

MarkTechPost 要点
  • GLM-5.3在Terminal-Bench 3.0上得分从4.6升至28.3
  • CyberGym得分达到84.5%,超过Mythos 5和GPT-5.6 Sol
  • 权重预计在发布后两周内公开
量子位 要点
  • GLM-5.3发布,编程能力接近Claude Fable 5,成为最强开源安全模型
  • 在CyberGym白盒代码审查中得分84.5%,发现漏洞2404个
  • 实测中能完成可交付的模拟游戏,并具备安全审计与修复能力

Grok 4.6登陆GitHub Copilot八个开发平台

xAI的Grok 4.6模型登陆GitHub Copilot,覆盖八个开发平台,支持Copilot Pro、Pro+、Max、Business和Enterprise计划。该模型在长时任务和终端编码方面表现突出,但部分计划需管理员启用。

Unite.AI 要点
  • Grok 4.6 在 Copilot 的八个平台可用,包括 VS Code、JetBrains、Xcode 等
  • 模型在 agentic 编码基准上表现优异,但部分指标落后于竞品
  • 商业和企业计划默认关闭,需管理员启用;按用量计费

Anthropic上调错位风险并搁置内部模型2

Anthropic发布风险报告,将高风险场景中灾难性错位风险从“极低”上调至“低”,并披露内部模型Model 2暂无外部发布计划。这一调整反映了对AI安全风险的更审慎评估。

Unite.AI 要点
  • Anthropic将错位风险从“极低”上调至“低”,反映不确定性增加。
  • 内部模型Model 2能力略超前沿模型Mythos 5,但未完成部署前评估。
  • 报告指出模型在隐蔽能力测试中表现有限,但存在潜在风险。

产品应用与市场动态

谷歌允许移除AI生成内容的可见水印

谷歌宣布允许用户移除Gemini和Flow生成的图片、视频和音乐中的可见水印,但不可见水印和C2PA元数据仍保留。该功能将在Gemini和Flow中提供,并开源新库Credentio。

TechCrunch AI 要点
  • 用户可关闭可见水印,但不可见水印和C2PA元数据仍保留
  • 该功能将在Gemini和Flow中提供,搜索支持即将推出
  • 谷歌开源新库Credentio以嵌入本地验证机制
The Verge AI 要点
  • 谷歌新增“媒体水印”设置,可关闭可见水印
  • 不可见SynthID和C2PA水印仍会保留
  • 该设置将推广至搜索,但不在要求可见水印的国家推出

OpenAI企业收入超越消费者业务

OpenAI首席财务官告知投资者,企业业务收入已超过ChatGPT消费者业务,提前实现预期,年化收入运行率400亿美元。这表明企业市场对AI服务的需求强劲。

Unite.AI 要点
  • 企业收入超过消费者业务,提前约两个季度。
  • 年化收入运行率400亿美元,企业客户数增长32%。
  • 广告业务年化运行率接近10亿美元。

中美AI价格战:OpenAI和Anthropic降价应对

OpenAI和Anthropic等美国AI实验室正降价以应对中国竞争对手的挑战,自7月中旬以来,美国领先实验室的模型价格已下降近四分之一。价格战反映了全球AI市场竞争的加剧。

Ars Technica AI 要点
  • OpenAI将GPT-5.6 Luna价格下调80%
  • Anthropic推出Claude Opus 5,价格减半
  • DoorDash和Airbnb等公司开始使用中国模型以降低成本

苹果与阿里合作开发中国定制AI模型

苹果与阿里巴巴合作,为中国市场开发定制AI模型,以支持其在中国推出的Apple Intelligence服务。这将是首家获准在中国提供专有AI模型的美国公司。

The Verge AI 要点
  • 苹果与阿里巴巴合作开发面向中国市场的定制 AI 模型。
  • 该模型将用于苹果在中国的设备端生成式 AI 服务。
  • 苹果已向中国监管机构注册该服务,预计未来几个月内推出。

法国初创公司Kog深挖GPU推理潜力

法国初创公司Kog致力于通过软件优化在现有数据中心GPU上实现更快的AI推理速度,其演示达到每秒3000 token的处理速度,并已获得200个商业线索。

TechCrunch AI 要点
  • Kog在Hacker News上展示技术预览,证明标准数据中心GPU可实现极速单请求解码
  • 公司计划加速大型模型开发,以满足客户需求
  • CEO认为GPU仍有巨大潜力,通过深入底层优化可解锁更多性能

百度文库网盘「库库AI」AI办公MAU超2500万

百度文库网盘「库库AI」AI办公月活跃用户超过2500万,并新推出办公独立端,进一步拓展AI办公市场。

量子位 要点
  • GenFlow中文名定为「库库AI」,AI办公MAU超2500万,行业第一
  • 推出独立端,包括PC客户端、网页端、小程序及企业版
  • 办公模式针对金融场景优化,内置金融数据与专家Skill

AI最佳ROI在于修复旧代码而非编写新代码

文章认为AI在修复遗留代码方面价值巨大,通过AI代理挖掘和保留机构知识,可显著缩短项目时间。这为AI应用提供了新的方向。

Unite.AI 要点
  • 遗留代码蕴含机构知识,AI可帮助挖掘
  • AI代理用于探索和分析阶段,而非直接重写
  • 项目时间从8.5个月缩短至4个月

算力与基础设施

超大规模企业押注天然气或面临价格风险

能源研究公司Noreva报告预测,随着超大规模企业需求激增、供应增长放缓及液化天然气出口上升,美国部分地区天然气价格可能上涨两倍,使AI数据中心运营成本大幅增加。

TechCrunch AI 要点
  • Meta、微软、谷歌和亚马逊计划建设大型天然气发电厂以支持AI数据中心
  • Noreva预测天然气价格可能在某些枢纽超过每百万英热单位10美元,而当前价格在2至4.5美元之间
  • 燃料成本约占大型电厂电力成本的一半,价格翻倍或三倍将推高AI数据中心运行成本

机器人研发算力需求两年涨10倍

具身智能机器人研发对算力需求两年增长5到10倍,阿里云无影灵构推出云端工作站,通过标准化环境、弹性算力和优化流化协议,降低机器人研发的算力成本和部署效率。

量子位 要点
  • 机器人研发算力需求两年增长5到10倍
  • 无影灵构云端工作站提供标准化环境和弹性算力
  • 自研ASP协议提升帧率并降低带宽占用

研究进展

世界首个超导量子热机有望助力大规模量子计算机

芬兰阿尔托大学的研究人员构建了世界首个超导量子热机,在接近绝对零度的条件下将热量转化为有用功,为未来量子计算机的自主运行提供了可能。

ScienceDaily AI 要点
  • 该热机结合了transmon量子比特、谐振器和量子冰箱
  • 实验在超导电路中重现了奥托循环
  • 研究发表在《自然通讯》上

科学家助力构建儿童细胞图谱

科学家Deanne Taylor推动将儿童纳入人类细胞图谱计划,并参与建立健康儿科组织数据库,以研究儿童发育和疾病。

MIT Technology Review 要点
  • Taylor发现人类细胞图谱计划最初仅研究成人,因此发起倡议纳入儿童。
  • 她参与推动NIH资助的dGTEx项目,建立健康儿科组织基因表达数据库。
  • 该数据库将作为儿童正常发育的基线,并可能揭示成年疾病的早期起源。

克隆技术可用于拯救物种或制造人类器官袋

科学家开发出将雄性小鼠胚胎转为雌性的CRISPR方法,克隆技术应用广泛,从保护濒危物种到可能制造无脑人类克隆体。

MIT Technology Review 要点
  • 新方法通过切除Y染色体将雄性小鼠胚胎转为雌性克隆。
  • 克隆技术已用于复制宠物、保护濒危物种,并可能复活灭绝物种。
  • 有公司提出制造无脑人类克隆体以提供器官,引发伦理争议。

KV缓存量化:几何问题而非比特问题

文章探讨了KV缓存量化中分组轴的选择对模型性能的巨大影响,指出键和值需要不同的量化处理方式。

Unite.AI 要点
  • 在2比特精度下,分组轴的选择可使基准分数从2.88变为63.53
  • 键和值需要不同的量化轴处理
  • 量化误差取决于组内数值范围,需考虑注意力消费后的误差变化

给受版权保护的动画角色赋予“秘密身份”

中国研究人员提出一种新方法,通过在推理时注入通用替身嵌入来保护受版权保护的动画角色,无需修改底层扩散模型。该方法在Stable Diffusion和Z-Image架构上均有效。

Unite.AI 要点
  • 提出在推理时注入锚定嵌入以替换目标角色,保留场景结构
  • 无需微调模型,可跨模型迁移
  • 在Stable Diffusion和Z-Image上验证了有效性

政策与监管

美国男子在法庭文件中注入AI提示以影响判决

美国康涅狄格州一名男子在法庭文件中隐藏仅AI可读的提示,试图影响AI系统对案件的判断,被法官认定为危险先例并受到制裁。

Ars Technica AI 要点
  • 该男子在文件中使用白字白底和微小字号隐藏提示,进行提示注入攻击。
  • 法官认为此举是严重的诉讼滥用,但未影响案件裁决。
  • 男子后续添加的提示被其称为玩笑,但仍受到制裁。

行业与人事变动

谷歌拆分DeepMind,团队划归总部

谷歌将DeepMind数个非技术团队划归总部,布林重新介入AI权力中心,推动资源向递归自我改进集中,Gemini发布延迟。

量子位 要点
  • DeepMind非技术团队被划归谷歌总部
  • 布林重新介入,推动递归自我改进
  • Gemini发布延迟两个月,落后竞争对手

余家辉离职Meta创业,年薪1亿美元留不住

余家辉在加入Meta一年后宣布离职创业,曾领导多模态团队推出Muse系列模型,Meta面临人才流失问题。

量子位 要点
  • 余家辉离职Meta创业,仅任职一年
  • 曾领导多模态团队,推出Muse系列
  • Meta已有超200名知名研究人员离职

印尼首个大学AI中心成立

印尼通信部、Indosat、NVIDIA和加查马达大学联合成立印尼首个大学AI技术中心,旨在培养本地AI人才,并启动医疗、农业和灾害应对等领域的AI项目。

NVIDIA Blog 要点
  • 该中心由NVIDIA全栈AI平台和Indosat的GPU Merdeka平台提供算力支持。
  • 首批项目包括AI结核病筛查、农业和自然灾害响应。
  • 中心将连接全球AI专家网络,推动印尼AI主权。

安全与伦理

Anthropic详解Claude文本水印机制

Anthropic发布文章详细解释未来Claude模型中文本水印的工作原理,基于Google DeepMind的SynthID-Text方法,旨在满足欧盟AI法案的合规要求。水印嵌入在单词选择中,不影响输出质量、成本或速度,但检测在短文本、事实性文本和代码上效果有限。

Unite.AI 要点
  • 水印基于SynthID-Text技术,通过替换随机性嵌入单词选择
  • 全球部署,不限于欧盟,因无法按地区精确限定
  • 检测在短文本、事实性文本和代码上效果有限,重写可移除

报告揭示AI深入真实网络攻击生命周期

Gambit Security的报告《AI Across the Intrusion Lifecycle》分析了三个威胁行为者如何将AI集成到入侵操作中,从生成脚本到分析数据,AI已成为攻击流程的一部分。

Unite.AI 要点
  • AI 在攻击中用于侦察、生成利用工具、分析数据等
  • 案例显示 AI 帮助攻击者适应环境并决策
  • Anthropic 分析显示 AI 在恶意活动中使用范围扩大

其他

中国机器人成网红,Unitree G1走红全球

波兰人将中国宇树科技的G1人形机器人改造成网红“Edward”,在社交媒体上获得大量关注。宇树科技即将上市,2025年已交付数千台机器人并实现盈利。

Wired AI 要点
  • Unitree G1 人形机器人被用作网红,在社交媒体上获得数十亿浏览量。
  • 宇树科技 2025 年交付 5511 台人形机器人,平均售价低于 2.5 万美元,并首次实现盈利。
  • 公司 43% 的销售额来自中国以外,即将在中国股市上市。

O'Reilly批评大型AI实验室,倡导开源AI

科技先驱Tim O'Reilly认为大型AI实验室的封闭模式不符合用户需求,主张开源AI技术,让用户拥有更多控制权,并警告前沿模型可能带来安全风险。

Wired AI 要点
  • O'Reilly 认为大型 AI 实验室的架构是控制而非自由,不符合用户需求。
  • 他主张开源整个 AI 技术栈,而不仅仅是开放权重。
  • 他认为前沿模型的安全风险应导致其发展放缓,而非限制开源模型。

当AI正确而流程出错时

文章讨论了AI部署中因流程问题导致的失败案例,强调组织流程和隐性知识对AI成功应用的重要性。

Unite.AI 要点
  • AI可能正确执行但流程缺陷导致失败
  • 组织流程未适应AI速度导致效率损失
  • 隐性知识未文档化影响AI决策