阿里开源Qwen3.8-27B,性能大幅提升
阿里开源Qwen3.8-27B模型,支持262K上下文,可外推至1M,编程和办公性能大幅提升,以Apache2.0协议开放,可免费商用。该模型在多个基准测试中表现优异,适合家用显卡运行。
量子位 要点
- Qwen3.8-27B开源,支持262K原生上下文,可外推至1M
- 编程和办公性能提升,超越Qwen3.7-Plus
- Apache2.0协议,免费下载部署及商用
阿里开源Qwen3.8-27B模型,支持262K上下文,可外推至1M,编程和办公性能大幅提升,以Apache2.0协议开放,可免费商用。该模型在多个基准测试中表现优异,适合家用显卡运行。
Z.ai发布GLM-5.3模型,基于GLM-5.2的743B基座模型,通过扩展后训练提升编码和网络安全能力,但权重暂未公开。该模型在编码任务上表现接近Fable 5,并修复了潜伏40年的bug。
xAI的Grok 4.6模型登陆GitHub Copilot,覆盖八个开发平台,支持Copilot Pro、Pro+、Max、Business和Enterprise计划。该模型在长时任务和终端编码方面表现突出,但部分计划需管理员启用。
Anthropic发布风险报告,将高风险场景中灾难性错位风险从“极低”上调至“低”,并披露内部模型Model 2暂无外部发布计划。这一调整反映了对AI安全风险的更审慎评估。
谷歌宣布允许用户移除Gemini和Flow生成的图片、视频和音乐中的可见水印,但不可见水印和C2PA元数据仍保留。该功能将在Gemini和Flow中提供,并开源新库Credentio。
OpenAI首席财务官告知投资者,企业业务收入已超过ChatGPT消费者业务,提前实现预期,年化收入运行率400亿美元。这表明企业市场对AI服务的需求强劲。
OpenAI和Anthropic等美国AI实验室正降价以应对中国竞争对手的挑战,自7月中旬以来,美国领先实验室的模型价格已下降近四分之一。价格战反映了全球AI市场竞争的加剧。
苹果与阿里巴巴合作,为中国市场开发定制AI模型,以支持其在中国推出的Apple Intelligence服务。这将是首家获准在中国提供专有AI模型的美国公司。
法国初创公司Kog致力于通过软件优化在现有数据中心GPU上实现更快的AI推理速度,其演示达到每秒3000 token的处理速度,并已获得200个商业线索。
百度文库网盘「库库AI」AI办公月活跃用户超过2500万,并新推出办公独立端,进一步拓展AI办公市场。
文章认为AI在修复遗留代码方面价值巨大,通过AI代理挖掘和保留机构知识,可显著缩短项目时间。这为AI应用提供了新的方向。
能源研究公司Noreva报告预测,随着超大规模企业需求激增、供应增长放缓及液化天然气出口上升,美国部分地区天然气价格可能上涨两倍,使AI数据中心运营成本大幅增加。
具身智能机器人研发对算力需求两年增长5到10倍,阿里云无影灵构推出云端工作站,通过标准化环境、弹性算力和优化流化协议,降低机器人研发的算力成本和部署效率。
芬兰阿尔托大学的研究人员构建了世界首个超导量子热机,在接近绝对零度的条件下将热量转化为有用功,为未来量子计算机的自主运行提供了可能。
科学家Deanne Taylor推动将儿童纳入人类细胞图谱计划,并参与建立健康儿科组织数据库,以研究儿童发育和疾病。
科学家开发出将雄性小鼠胚胎转为雌性的CRISPR方法,克隆技术应用广泛,从保护濒危物种到可能制造无脑人类克隆体。
文章探讨了KV缓存量化中分组轴的选择对模型性能的巨大影响,指出键和值需要不同的量化处理方式。
中国研究人员提出一种新方法,通过在推理时注入通用替身嵌入来保护受版权保护的动画角色,无需修改底层扩散模型。该方法在Stable Diffusion和Z-Image架构上均有效。
美国康涅狄格州一名男子在法庭文件中隐藏仅AI可读的提示,试图影响AI系统对案件的判断,被法官认定为危险先例并受到制裁。
谷歌将DeepMind数个非技术团队划归总部,布林重新介入AI权力中心,推动资源向递归自我改进集中,Gemini发布延迟。
余家辉在加入Meta一年后宣布离职创业,曾领导多模态团队推出Muse系列模型,Meta面临人才流失问题。
印尼通信部、Indosat、NVIDIA和加查马达大学联合成立印尼首个大学AI技术中心,旨在培养本地AI人才,并启动医疗、农业和灾害应对等领域的AI项目。
Anthropic发布文章详细解释未来Claude模型中文本水印的工作原理,基于Google DeepMind的SynthID-Text方法,旨在满足欧盟AI法案的合规要求。水印嵌入在单词选择中,不影响输出质量、成本或速度,但检测在短文本、事实性文本和代码上效果有限。
Gambit Security的报告《AI Across the Intrusion Lifecycle》分析了三个威胁行为者如何将AI集成到入侵操作中,从生成脚本到分析数据,AI已成为攻击流程的一部分。
波兰人将中国宇树科技的G1人形机器人改造成网红“Edward”,在社交媒体上获得大量关注。宇树科技即将上市,2025年已交付数千台机器人并实现盈利。
科技先驱Tim O'Reilly认为大型AI实验室的封闭模式不符合用户需求,主张开源AI技术,让用户拥有更多控制权,并警告前沿模型可能带来安全风险。
文章讨论了AI部署中因流程问题导致的失败案例,强调组织流程和隐性知识对AI成功应用的重要性。