← Back to Reports

🤖 AI 行业报告

模型发布 · 产品更新 · 行业动态 · 论文研究 · 技巧观点
2026-08-20 · 共 5 条(已去重前两日报道)
🌐

行业动态

2 条
1

Stripe 确认 75 亿美元收购 OpenRouter:AI 路由平台估值半年翻近 6 倍✅ 结构化源

IT之家 + OpenRouter 官方公告 · 8月20日

传闻落地:Stripe 确认收购 AI 路由平台 OpenRouter,知情人士称交易价格达 75 亿美元——远高于其今年 5 月融资时 13 亿美元的估值。OpenRouter 官方博客同步宣布"加入 Stripe":平台目前每日处理来自 400 多个 AI 模型的 10+ 万亿 token,服务超 1000 万开发者与公司,自成立以来推理量每年至少增长 10 倍。

交易完成后 OpenRouter 将继续以原名、原使命独立运营,产品与路线图不变,路由决策仍以用户利益为先,交易预计在未来数周内完成。Stripe 创始人称将 1 月 1 日视为"奇点"开始。支付巨头买下"模型层入口",AI 推理流量的分发权正式成为巨头必争之地。

🔗 查看原文
2

OpenAI CFO 告知员工:公司最迟 2027 年上市,本季度年化营收增长 35%✅ 结构化源

IT之家 · 8月20日 08:17

据IT之家,OpenAI 首席财务官萨拉·弗里亚尔在全员大会上告知员工:公司最迟将于 2027 年完成上市,若业务持续向好也可能更早。OpenAI 已于 6 月秘密提交 IPO 招股书。

披露的经营数据:本季度整体年化营收增长 35%,企业级业务年化营收增长 50%,AI 编程与办公产品周活跃用户突破 2000 万。此前 WSJ 报道其 Q2 营收增速 18% 落后于 Anthropic——口径差异(季度同比 vs 年化)提示,两组数字需对照看待;但"2027 年上市"的时间表本身已是本届 IPO 周期最重要的节点之一。

🔗 查看原文
📦

产品发布/更新

1 条
3

FastMetal:Mac 本地 30 秒生成 5 秒视频,无需 CUDA 与云端✅ 结构化源

X:Sky Computing Lab (@haoailab) · 8月20日 04:42

Sky Computing Lab 发布 FastMetal:一段 5 秒 480P 视频完全在 Mac 上本地生成,耗时 30 秒,无需 CUDA、无需云端,仅占用 3.9 GiB 内存。FastMetal 将 FastWan-QAD 系列带到 Apple Silicon——DiT、DMD 采样器和解码器均通过 MLX 在 Metal 上运行,默认 INT8。

模型三档:1.3B 支持 480P,5B 支持 720P,14B 追求画质。博客、代码(github.com/hao-ai-lab/FastVideo)与模型权重(Hugging Face FastVideo 合集)已全部开放。端侧视频生成正在从"能跑"走向"能用"。

🔗 查看原文
🧠

模型发布/更新

1 条
4

Liquid AI 发布 LFM2.5 系列 QAD Q4_0 量化检查点:恢复 97% 精度损失✅ 结构化源

Hugging Face 博客 · 8月19日 21:48

Liquid AI 发布基于量化感知蒸馏(QAD)训练的 LFM2.5-230M、350M、1.2B-Instruct 和 2.6B 四款 Q4_0 GGUF 检查点:在保持原生 Q4_0 内存占用与推理速度的同时,恢复 BF16 平均精度损失的 97%。

小模型 + 高保真量化是端侧 AI 的关键拼图——QAD 路线让小参数模型在极限压缩下几乎不掉点,与同日 FastMetal 的端侧视频生成形成呼应:本地 AI 体验的瓶颈正被系统性拆除。

🔗 查看原文
📖

论文研究

1 条
5

LMSYS:H20 上服务 1.6T 参数 DeepSeek-V4-Pro,性能差距缩至 B300 的 1.42 倍✅ 结构化源

LMSYS 博客(Chatbot Arena 团队) · 8月20日 01:56

LMSYS 团队针对 1.6 万亿参数的 MoE 模型 DeepSeek-V4-Pro,在 H20 GPU 上通过场景化服务配置逼近 B300 性能:单节点 H20-141GB 参考实现达 271 output tokens/s,与 B300 的 383.7 tokens/s 差距缩小至 1.42×。

在出口管制限制高端 GPU 供给的背景下,"受限硬件 + 服务层优化"的工程路线持续兑现价值——H20 上的可用吞吐,意味着合规算力的实际服役能力比纸面参数强得多。

🔗 查看原文