AI日报(2026.07.20)
AI日报(2026.07.20)
🏆 今日最佳:Qwen3.8开源发布(2.4T参数,仅次于Fable 5)— 模型发布 | 阿里开源全球第二大模型,Max-Preview已上线
▎今日视点
2.4万亿参数,一场AI军备竞赛的临界点。 当Alibaba Qwen团队在X上官宣Qwen3.8拥有2.4T参数、仅次于Fable 5时,全球开源模型的天花板被重新定义——不是一个模型的发布,而是一个信号:中国AI公司正在从追赶者变成定义者。同一天,面壁智能以端侧模型拿下4B以下性能全球第一,昆仑万维在WAIC上宣布2026为"世界模型元年",三家公司从端侧到超大模型完成了全链路版图。
为什么这三件事同一天发生? 不是因为巧合,而是因为AI行业的底层竞争逻辑已经变了。在此之前,超大模型的战争集中在OpenAI、Anthropic、Google几家之间,开源生态只能"跟在后面捡残羹"。但Qwen3.8的出现意味着开源阵营第一次有了与闭源顶级模型正面抗衡的火力——2.4T参数的体量不是渐进式改进,而是一次跃迁。与此同时,Netflix以5.87亿美元收购Ben Affleck的AI电影初创公司和ChatGPT Work的正式上线告诉市场:AI不再只是一个模型竞赛,而是正在渗透到影视生产、办公效率、甚至语音转录的每一个基础设施层面。
我的判断:2026年7月这一周,将被称为"开源模型的分水岭"。 证据链有三:第一,Qwen3.8的2.4T参数超过了绝大多数闭源模型,开源社区(Ollama刚获8800万美元融资,890万开发者)的生态基础设施已经成熟到可以承载超级模型;第二,面壁智能同时发布MiniCPM5-2B和MiniCPM-Robot,说明中国AI公司不再只堆参数,而是同步发力端侧和具身智能的落地场景;第三,黄仁勋访日签约建设Vera Rubin AI工厂(2028年投运)表明算力基础设施建设从未停歇。当开源模型在能力上第一次跑进第一梯队,当端侧模型能够驱动机器人,当算力工厂在全球铺开——AI的下一阶段不是AGI抵达的终点,而是人人都能调用顶级智能的起点。
▎今日要闻
阿里开源Qwen3.8:2.4T参数模型仅次于Fable 5,Max-Preview已上线 — Alibaba Qwen官方X — 29/30 > 历史上首次有开源模型以2.4万亿参数逼近闭源顶尖水平,且无需等待——Max-Preview已在Token Plan、Qoder和QoderWork上开放测试。
Ollama获8800万美元融资:Benchmark领投,890万开发者、85%财富500强已在用 — Ollama官方博客 — 27/30 > 一个本地运行模型的工具,成长为企业级AI基础设施不可或缺的一环,token用量月均翻倍的增速说明开发者正在用脚投票。
Netflix以5.87亿美元收购Ben Affleck的AI电影初创公司InterPositive — TechCrunch — 26/30 > 好莱坞与硅谷的融合不再只是炒作,Netflix用真金白银押注AI驱动的影视制作将成为内容生产的标配。
ChatGPT Work功能正式上线:建站、邮件、文档处理一网打尽 — Tibo via X — 26/30 > ChatGPT不再只是聊天机器人,Work让它变成了一个移动办公套件,Plus用户即可使用,此举直接对标Google Workspace和Microsoft 365。
黄仁勋访日:Nvidia联手日本建设Vera Rubin AI工厂,2028年投运 — TechCrunch — 26/30 > 配备13750颗Vera CPU和27500颗Rubin GPU的AI超级工厂,标志着主权AI基础设施竞赛从欧美蔓延到东亚。
面壁智能MiniCPM5-2B发布:4B以下参数量全球性能第一,适配9款芯片 — 面壁智能公众号 — 25/30 > 2B参数的"小钢炮"在AA-Index拿到4B以下最高分,原生混合思考+512K上下文,端侧AI的天花板又被抬高了。
前端圈7月大地震:TypeScript 7发布、Bun 11天从Zig迁移到Rust、Kimi K3登顶 — 稀土掘金 — 25/30 > 三大事件同周引爆前端圈,其中Bun的Rust移植是一个标志性技术决策——Zig虽好,Rust的生态和人才池才是规模化选择的胜负手。
▎科技动态
⚡芯片与算力 黄仁勋访日签下Vera Rubin AI工厂大单 — TechCrunch — 26/30 > Nvidia以日本为跳板向全球输出主权AI工厂模式,2028年投产的时间线意味着未来两年的算力军备竞赛只会更加激烈。
🤖Agent与应用 ChatGPT Work上线:建站、邮件管理、文档处理三合一 — Tibo via X — 26/30 > Plus、Pro、Business和Enterprise用户均可使用,ChatGPT正从对话工具进化为全能工作台。
🎨内容与生成 昆仑万维在WAIC宣布2026为"世界模型元年",发布Matrix-Game 3.5 — 昆仑万维公众号 — 24/30 > 5B模型在720p分辨率下单卡可达20FPS实时生成,Patch级记忆注入技术让世界模型有了"记住"能力,核心架构已开源。
🔧框架与工具 Claude Code开始在Rust重写的Bun上运行 — Simon Willison — 25/30 > Bun创始人Jarred Sumner宣布将Bun从Zig迁移到Rust,Claude Code v2.1.181已用上Rust版Bun,Linux启动速度快了10%。
MiniCPM-Robot开源:面壁智能发布具身智能VLA模型系列 — 面壁智能OpenBMB — 24/30 > 1.5B参数的视觉-语言-动作模型MiniCPM-RobotManip实现机器人理解、记忆与行动,推理框架PhyAI同时开源。
transcribe.cpp v0.1.0发布:基于ggml的跨平台语音转录库 — CJ Pais Workshop — 22/30 > 支持16个ASR模型族(60+模型),通过Vulkan、Metal、CUDA和TinyBLAS实现GPU加速,本地语音转录再无门槛。
▎社会观察
Christopher Nolan称AI为"特洛伊木马" — TechCrunch — 24/30 > "人人都知道希腊人藏在里面。"《奥德赛》导演Nolan以尖锐的比喻提醒:AI表面是礼物,内里可能藏着控制权之争。当整个行业沉浸在技术狂欢中,这种来自文化界的警醒值得认真对待。
AI热潮正在瓦解全球决策机制 — Nik Suresh / Hacker News — 25/30 > 一位拥有300多次行业咨询经验的从业者透露,过去18个月其团队所见的所有AI项目全部失败(成功率0%),有高管承认从未用ChatGPT却撰写了20亿美元营收体量的AI战略。这不是技术问题,是组织理性崩塌。
9to5Mac调查:巴西App Store出现60+伪装赌博App — Daring Fireball — 22/30 > 这些"夹克应用"伪装成导航、旅行、天气类应用,上架后变身为赌博平台。AI生成的动物图标和描述让审核更难甄别,平台治理面临新挑战。
Apple对OpenAI法律战持续:硬件计划能否幸免? — TechCrunch — 20/30 > Equity播客的辩论揭示了一个关键问题:Apple的大规模诉讼不仅针对人才流失,更可能通过法律手段迟滞OpenAI的硬件和IPO计划。不过这是昨日头条的追踪报道,新鲜度有限。
▎文章
AI Mania Is Eviscerating Global Decision-Making — Nik Suresh > 荐读理由:匿名高管自曝从未用过AI却制定了20亿AI战略,辛辣程度堪比硅谷黑色喜剧。
Controlling Reasoning Effort in LLMs — Sebastian Raschka > 荐读理由:权威技术解读LLM如何学习低/中/高三种推理模式,理解模型能力边界的必读材料。
MCP vs A2A vs ACP: How AI Agents Actually Talk to Each Other — ByteByteGo > 荐读理由:三大Agent通信协议的横向对比,选型前看这一篇就够。
▎工具与资源
transcribe.cpp — GitHub / Workshop 基于ggml的跨平台语音转录库,支持16个ASR模型族、GPU加速,本地运行无需联网。
SQLite Query Explainer — Simon Willison / Julia Evans Fable 5构建的交互式SQLite查询计划解释器,在浏览器中跑Pyodide解析EXPLAIN输出。
Paper — Daring Fireball 专业设计工具,每一层都是真实HTML/CSS,支持通过MCP连接AI Agent读取和编辑设计。
▎数读
- 2.4万亿:Qwen3.8的参数量,仅次于Claude Fable 5,阿里开源了全球第二大模型
- 8800万美元:Ollama本轮融资金额,Benchmark领投,890万开发者正在使用
- 5.87亿美元:Netflix收购Ben Affleck AI电影初创公司InterPositive的现金价格
- 85%:财富500强中使用Ollama的比例,本地模型已成企业标配
- 13750颗:日本Vera Rubin AI工厂将配备的Vera CPU数量
- 60+:9to5Mac在巴西App Store发现的伪装赌博应用数量
- 0%:某咨询团队过去18个月所见AI项目的成功率
- 512K:MiniCPM5-2B原生支持的上下文长度,端侧模型从未如此强大
▎言论
> "Everybody knows the Greeks are inside." > — Christopher Nolan,导演,将AI比作特洛伊木马
> "过去一年半,我们团队所见的每一个AI项目都失败了。成功率0%。" > — Nik Suresh,匿名行业顾问,揭露企业AI狂热下的真实困境
> "Boring is good." > — Jarred Sumner,Bun创始人,谈论从Zig迁移到Rust后"没什么变化"才是最大的成功
> "Claude Fable 5 will be included in all Max and Team Premium plans, at 50% of limits." > — @claudeai,宣布Fable 5从7月20日起永久纳入付费计划
🔥 今日社区热议
- Grok 4.5 PK GPT-5.6 Sol — · 🔥🔥🔥 V2EX用户实测对比两大模型的code能力,有用户称Grok 4.5在长上下文代码生成上表现反超,但也有人表示Sol的单次推理准确率更高。社区共识:选择取决于具体场景,不存在绝对胜者。 来源:V2EX
- chatgpt work 的 9 核 16G 容器 — · 🔥🔥🔥 ChatGPT Work上线后,技术咖们立刻扒出了其背后分配的资源规格——每个用户得到9核CPU和16GB内存的容器,用来跑网站托管和文档处理。社区讨论焦点:这配置打游戏都够了,OpenAI的云计算野心藏不住了。 来源:V2EX
- DeepSeek V4 正式版即将发布 — · 🔥🔥🔥 知乎热榜上关于DeepSeek V4的讨论持续升温,用户关注点集中在V4能否在推理和代码能力上对标GPT-5.6和Grok 4.5。社区讨论认为,DeepSeek一直以高性价比著称,V4的定价策略或将重塑API市场格局。 来源:知乎
- 前端圈7月大地震 — · 🔥🔥🔥 掘金社区热议TypeScript 7发布、Bun 11天从Zig迁Rust、Kimi K3登顶三件大事同周发生。资深前端开发者感叹"学了十年的Zig说不要就不要了",但更多人认可Rust的人才生态是Bun转型的真正原因。 来源:稀土掘金
- Ollama 获 8800 万美元融资 — · 🔥🔥🔥 Hacker News上Ollama融资消息引发激烈讨论,核心争议是"本地运行模型是否真能对抗云端API派"。支持者认为Ollama的数据隐私优势和低延迟无可替代,质疑者担心Benchmark领投意味着未来可能走向商业化收费。 来源:Hacker News via buzzing.cc
写在最后
今天最值得记住的画面不是Qwen3.8的2.4T参数数字本身,而是开源第一次真正站在了与闭源同一起跑线上——当阿里、面壁、昆仑万维三家公司同一天从端侧到超大模型完成闭环,AI的竞争已经从"谁有最牛的模型"变成了"谁能最快地把顶级智能交到每个人手上"。接下来值得追踪的信号:DeepSeek V4正式版能否延续高性价比路线对抗Qwen3.8,以及中美AI公司在开源策略上的博弈会走向何方。
评分参考:基于影响力×新颖性×破圈度三维评估。≥27=强烈推荐,24-26=值得关注,20-23=快速扫读。