Gemini 官方账号宣布:Gemini 3.7 Flash 现已向 Gemini 聊天中的 Pro 和 Ultra 用户开放。本次更新提升了多步骤任务的推理与准确性——例如把数十个文件和邮件智能整合为一份主文档。同时,个人 AI 智能体 Gemini Spark 也已运行在 3.7 Flash 上,通过改进对 Google Workspace 应用的工具调用变得更精准。发布次日即完成付费层全量覆盖 + Spark 智能体同步切换,Google 在"工作型模型"上的迭代-分发闭环明显加快(该模型 8月13日发布,输入/输出 $0.75/$3.75 每百万 token)。
🔗 查看原文通义千问官方宣布兑现承诺,开源 Qwen3.8 系列模型。其中 Qwen3.8-27B 为原生多模态稠密模型:仅 27B 参数即全面超越 Qwen3.7-Plus,原生支持 262K 上下文、可通过 YaRN 扩展至 1M tokens,采用 Apache 2.0 许可;Max 级 Qwen3.8-2.4T-A95B 的开放权重也同步发布(该模型参数与上下文规格见 8月13日报道)。"27B 打平上代 Plus 级"的密度跃升是本次发布的最大亮点——小尺寸多模态 + Apache 2.0 的组合对企业私有化部署极具吸引力。
🔗 查看原文小红书技术团队开源 dots3-note Preview——dots3 系列的最轻量模型:总参数 280B、激活参数 16B,支持 512K 上下文及文本、视觉、语音多模态理解,针对复杂推理和长程 Agent 任务优化。16B 激活参数承载 512K 上下文 + 全模态输入,延续了"稀疏 MoE 压成本"的工程路线;小红书连续两周开源语音(dots.tts)与多模态模型,其 dots 系列的开源节奏正在向一线实验室看齐。
🔗 查看原文Cursor 官方博客宣布:Cursor 已被 SpaceX 正式收购,完成自 4 月启动的收购流程。合并后 Cursor 将获得全球最大的 GPU 集群,用以构建更强且运行成本更低的模型,从而以更低价格向客户提供更强模型;本周三发布的 Grok 4.6 正是双方合作成果的早期体现。AI 编码工具与算力巨头的垂直整合落地——Cursor 从"调用第三方模型的编辑器"变为"自有算力+自有模型"的全栈玩家,AI IDE 竞争格局被彻底改写。
🔗 查看原文Anthropic 公布:未来 Claude 模型生成的文本将包含水印,用于判断文本由 Claude 撰写的可能性——这是为遵守欧盟《AI 法案》而实施的变更。该技术基于 Google DeepMind 的 SynthID-Text,对输出质量、创造力和可读性无实际影响,读者无法区分水印文本与普通文本,且不增加额外 token 或成本。头部实验室首次将文本水印从研究推向默认部署,为 AI 内容溯源树立合规矩例;水印能否经得住改写/翻译攻击将是后续关注焦点。
🔗 查看原文Ars Technica 报道:OpenAI 和 Anthropic 正在进行价格战,与此同时中国 AI 竞争对手正在扩大地盘。源页面未提供摘要,但结合本周公开事实可见背景:Gemini 3.7 Flash 价格减半、GPT-5.6 以 25 倍成本压缩追平上代(BrowseComp),而 DeepSeek V4 Pro($1.32/M 输入)与 Qwen3.8 系列相继开放权重——价格战的挤压效应正在重塑全球模型市场的定价锚。详细数据与引语以 Ars 原文为准。
🔗 查看原文Hugging Face 发布 2026 年夏季开源模型生态报告:1-8 月公开模型仓库从 243 万增至 296 万,但 85.6% 的模型下载量不足 200 次,1.5% 的仓库占据 99.2% 的下载量。中国实验室月度最大开源模型参数规模在 754B 至 2.78 万亿之间,而美国实验室七个月中有五个月低于 130B;AMD 与 NVIDIA 各发布超 200 个新模型仓库,成为发布开源模型最多的机构。开源生态的"长尾死亡、头部通吃"格局与中国在超大模型开源上的规模优势,是这份报告的两个核心信号。
🔗 查看原文