智谱 GLM-5.3 API 即日上线,主打复杂编码、防御性网络安全与长程任务。在 AA 综合智能指数中取得 60 分,官方称与 Claude Fable 5、GPT-5.6 Sol 等闭源旗舰同级,并与 Kimi K3 并列开源模型第一。
成本是本次发布的核心卖点:以更小参数规模和更低调用成本降低前沿智能门槛,单任务成本为旗舰模型中最低,API 定价与 GLM-5.2 持平。模型权重将于下周五开源——延续智谱"API 先行、权重随后"的开源节奏,届时开源模型第一梯队(GLM / Kimi / Qwen / DeepSeek)的竞争将再添变量。
🔗 查看原文Claude 连接器上新:可以在 Gmail 中发送邮件,并管理 Google Drive 中的文件。让 Claude 回复某个邮件线程,它会起草并发送回复,用户可以控制何时需要人工批准。从连接器菜单中选择连接 Gmail 或 Google Drive 即可试用,所有付费套餐均可用。
这是 Claude 从"只读助手"向"可执行代理"迈出的又一步——此前连接器多以读取和检索为主,本次开放了发送邮件这一写入类操作,配合审批机制控制风险。
🔗 查看原文Modular 宣布 Mojo🔥 语言正式开源,采用 Apache 2.0 许可证(含 LLVM 例外),编译器、工具链及全部源码已发布至 Modular GitHub 仓库。Mojo 上周刚达成 1.0 版本(源码稳定),此次开源涵盖整个编译器与工具链。
目前官方暂不接受编译器相关贡献,计划年底前开放;标准库自 2024 年起已接受社区贡献。Mojo 定位 AI 时代的系统级语言,开源后能否撬动 GPU 编程生态值得观察。
🔗 查看原文OpenAI 发布 ChatGPT for Teens,为 13-17 岁用户自动启用,内置更强安全保护与家长控制。新增 Study Mode、负责任作业提醒、测验与学习可视化,以及可设定默认开启时段的 Study Hours,引导青少年分步解题而非直接给答案。
OpenAI 同时宣布与 CodeAI 合作,帮助青少年理解、质疑并创造性地使用 AI。在各国监管紧盯未成年人 AI 使用的背景下,这是头部厂商首次推出独立的青少年产品线。
🔗 查看原文Cursor 即日起向所有付费计划用户开放 Origin 代码托管的早期测试版,提供仓库、拉取请求、代码浏览及 GitHub 同步功能。用户可创建以 cursor.com/codebase/ 为前缀的仓库,或将 GitHub 仓库同步至 Origin,双向同步评论与审查。
Vercel、Depot 和 Buildkite 集成已可用,智能体功能即将推出。从编辑器到代码托管,Cursor 正在补全开发工具链的闭环,与 GitHub 的关系从"寄生"走向"竞合"。
🔗 查看原文Sentence Transformers v6.0 新增第四种模型类型 MultiVectorEncoder,可直接加载 PyLate、Stanford-NLP ColBERT 及 colpali-engine 检查点,用于 ColBERT 式晚期交互(late interaction)检索。
晚期交互模型在检索精度上显著优于单向量稠密检索,但此前工程接入成本高。本次纳入 ST 统一接口后,RAG 开发者可以用熟悉的 API 直接调用 ColBERT 类模型,多向量检索的采用门槛大幅降低。
🔗 查看原文404 Media 通过在一本珍本图书中放置追踪设备,首次揭露亚马逊一项未公开的购书行动:批量购入大量书籍,扫描用于 AI 训练数据,随后销毁。追踪显示这些书最终被送往亚马逊的一处人工智能训练中心。
这是继多家厂商被曝使用盗版书库训练后,"实体书数字化训练"首次被实地追踪证实。批量购书—扫描—销毁的流程规避了数字版权检测,但物理销毁书籍的行为预计将引发新一轮的版权与伦理争议。
🔗 查看原文Anthropic 公布两项实验:Claude(Mythos Preview 和 Opus 4.8)针对 15 个靶点设计蛋白质结合剂,成功 14 个,命中率达 22.6%-35.1%。
这是 Anthropic 首次系统披露 Claude 在蛋白质设计任务上的实验数据。22.6%-35.1% 的命中率若可复现,意味着大模型辅助的结合剂设计可以将候选筛选成本压缩一个数量级——AI for Science 正在从"辅助文献调研"走向"直接产出候选分子"。
🔗 查看原文IBM Research 对八款模型的评测显示:智能体记忆并非可随意开启的功能,而是需按模型能力校准的"剂量"。强模型适合注入完整指南集——DeepSeek-V3.2(671B MoE)任务完成率提升 +9.5 个百分点;较弱模型采用精选检索效果最佳——gpt-oss-120b(117B MoE)提升 +16.1pp 且仅增加 +5% token。
该方法无需更新权重或人工标注,通过从智能体过往轨迹中蒸馏指南并在推理时注入实现。对正在搭建 Agent 记忆系统的团队,这是一份少见的"按模型分层"的实证配置指南。
🔗 查看原文OpenAI 官方披露:因 OpenAI-Hugging Face 事件及即将推出的 Astra 模型可能达到《预备框架》下的"关键网络安全能力"阈值,公司暂时放缓模型扩展速度——包括暂停最新部署模型的强化学习训练两周,并搁置最大规模前沿 RL 运行。
公司已加强研究环境安全,要求对 Astra 及网络相关负载实施最严格防护,并扩展思维链监控,采用多阶段激活分类器检测机制。头部实验室主动"踩刹车"并公开细节,为行业安全治理提供了一个具体的操作样本。
🔗 查看原文Anthropic 的 CI 工程师用 Claude Tag 构建了值班智能体,作为 CI/CD 故障的一线响应者。Claude 在事故发生后中位 14 分钟发布首份基于证据的分析,最快案例中 3 分钟内验证修复并确认错误率恢复基线。
该方案通过 Slack 频道、Datadog 或 Grafana 工具访问及 GitHub 技能文件实现,Anthropic 已发布通用设置套件供其他团队部署。AI 值班不再是概念演示——这是头部实验室公开的、有具体时延数据的的生产级 on-call 实践。
🔗 查看原文Google 开源了基于 ADK 和 Gemini 的零信任客服与退货智能体示例,演示如何防御提示注入等攻击。该架构在 LLM 上下文之外设置三层硬性安全机制:硬件支持的加密签名确保数据库写入不可抵赖、gVisor 沙箱隔离动态代码执行、确定性语义网关校验业务逻辑。
核心观点:系统提示词只是软约束,无法作为安全边界。把安全从"提示词工程"下沉到"系统架构",是 Agent 进入生产环境前必须完成的范式转换。
🔗 查看原文本文演示如何用开源评测框架 Inspect AI 和 Harbor 评估 Agent 技能,并借助 Google Sheets 和 Data Studio 进行可视化分析。
文章的方法论重心在"先清晰、后美观":评测设计的首要目标是让结果可解释、可复现,可视化只是最后一步。对正在为 Agent 搭建评测流水线的团队,这是一条低成本的入门路径。
🔗 查看原文作者基于 Reddit 上"让 Claude 真正开始思考"的帖子,引入逻辑学中的"钢人论证"(steelman)概念,自创"双向钢人 Prompt":重述真实问题、强化正反双方观点、找出关键变量、逼 AI 给出明确判断四步,旨在避免模型谄媚,帮助用户找到问题最本质的答案。作者以自己选择公司司庆日的真实案例演示了使用效果。
"先构建最强反方、再要求裁决"的结构,是目前对抗大模型迎合倾向最简单有效的提示策略之一。
🔗 查看原文一份面向希望减少技术环境中侵入式 AI 的用户的操作指南,涵盖 Adobe Acrobat、Android/Gemini、Apple Intelligence、Chrome、Edge、Firefox、DuckDuckGo、Google Workspace、Slack、WhatsApp 及 Windows 11/Copilot 等平台。
指南在 HN 引发热议,反映出"AI 默认开启"策略正在积累用户反弹——对产品经理而言,这份清单同时也是一份"用户最不想要的 AI 功能"的反向需求文档。
🔗 查看原文