AI双周速递·第二期:Qwen3.8-Max 开源炸场,字节 SeedRealtime 边看边聊
本期导读:追踪 AGI 新应用,探寻 AI 真善美。AI 双周速递是 AIJVS 的固定栏目,每两周更新一次,帮你过滤噪音、直击重点。本期覆盖 8 月 6 日 ~ 8 月 12 日。
本期速览(3 分钟看完)
- 阿里开源 Qwen3.8-Max:2.4 万亿参数旗舰首次开源,编程能力直接对标 Claude 系列,程序员一句话就能让它从空文件夹写完整个项目。
- 字节发布 SeedRealtime:原生音视频全双工大模型,豆包 App 已全量上线,”边看、边听、边说”不再是 PPT。
- DeepSeek V4-Pro 正式版进入倒计时:API 宣布大幅涨价,业界推测正式版即将发布,想省钱的抓紧。
- OpenAI 风波不断:GPT-6 被曝 8 月强行发布,同时因 Astra 模型”自主攻防能力过强”暂停部分研发。
- 全国产 10 万卡超集群”曙光8000”投用:国产算力基建里程碑,AI 训练不再看美国脸色。
重点深度(值得展开的 2 条)
一、Qwen3.8-Max:国产开源模型的新王座
一句话:这是千问系列史上最大、最强的模型,也是首个对外开源的 Max 级别旗舰——总参数 2.4 万亿,单次激活约 950 亿参数,支持 100 万 Token 上下文,原生集成多模态视觉理解。
为什么值得关注?
- 编程能力登顶开源阵营:在 Frontend Code Arena 排行榜位列第四(1668 分),仅次于 Claude Opus 5 (Max) 的 1705 分和 Kimi K3 (Max) 的 1676 分。
- 自主编程新突破:官方演示中,程序员只需一句话指令,模型可从空文件夹出发独立完成真实项目交付,连续自主工作数天几乎不需要人插手。
- “两万亿俱乐部”第二人:继 Kimi K3(2.8 万亿)之后,Qwen3.8-Max(2.4 万亿)成为国产大模型第二位成员。开源阵营对闭源模型发起新一轮冲击。
对普通用户意味着什么?
- API 已上线千问 AI 平台,下周权重正式开源——这意味着你可以免费部署一个 2.4 万亿参数的编程助手(如果你的显卡扛得住)。
- 对个人开发者来说,Qwen3.8-Max 的办公 Agent 能力(Cowork)值得一试:写周报、做 PPT、整理数据,一条龙。
💡 怎么用起来:打开 千问 AI 平台 就能直接用 Max 模型;开发者等下周开源后可用 Ollama 或 vLLM 本地部署。想了解部署细节,先看我们的 开源大模型部署指南。
二、字节 SeedRealtime:音视频实时对话,豆包先上了
一句话:字节跳动 8 月 5 日发布原生音视频全双工大模型 SeedRealtime,用统一架构原生融合音频、视频与文本,在连续多模态信息流上实时交互——“边看、边听、边说”。
为什么值得关注?
- 原生全双工:不是”语音识别 + 文本回复 + 语音合成”的拼接,而是端到端统一架构,对话节奏问题比级联模型减少一半,单次对话完整顺畅交流概率显著提升。
- 已经能用:SeedRealtime 已在豆包 App 全量上线,更新到最新版本即可体验,不是发布会 PPT。
普通用户怎么玩?
- 打开豆包 App,试试对着摄像头问它”我这盆绿萝是不是该浇水了”——它能边看边说。
- 这是 AI 从”打字聊天”走向”真人对话”的关键一步,未来客服、教学、陪伴场景都会变。
💡 延伸阅读:想理解多模态模型背后的原理,可看我们的 大语言模型(LLM)原理。
工具上新(值得试的)
| 工具/模型 | 一句话点评 | 上手难度 |
|---|---|---|
| Qwen3.8-Max(阿里) | 2.4T 参数编程旗舰,下周开源 | ⭐⭐ |
| SeedRealtime(字节) | 豆包 App 直接体验音视频对话 | ⭐ |
| Hy ASR 3.0 preview(腾讯混元) | 新一代语音识别,元宝免费开放 | ⭐ |
| Pokee-Isaac 28B(Pokee AI) | 1000 万 Token 上下文的 Agent 模型,RULER@10M 93.3% | ⭐⭐⭐ |
| MedBench 5.0(上海AI实验室) | 钟南山等院士共建的医疗大模型评测基准 | ⭐⭐⭐ |
避坑提醒
- DeepSeek API 要涨价:V4 系列高峰时段百万 Token 输入从 3 元涨到 6 元,输出从 6 元涨到 12 元。日常高频调用前先评估成本,或转用 V4-Flash 轻量版。
- GPT-6 传闻别全信:X 平台爆料”8 月强行发布”目前是自媒体消息,官方未确认。警惕借此炒币、卖课的。
- “自主攻防能力过强”是双刃剑:OpenAI 暂停 Astra 模型部分研发说明 AI 安全不是玩笑。用 AI 写代码时,涉及生产环境的指令务必人工 review。
学习建议
- 想真正看懂这些大模型:先读 Transformer深度解读,再读 大语言模型(LLM)原理。
- 想动手跑模型:WebGPU 直接在浏览器跑,零成本本地推理实战,不用买显卡。
- 想选对模型:看 [国产大模型横评:DeepSeek / Kimi / Qwen / GLM 谁更值得用?](/2026/08/06/国产大模型横评:DeepSeek Kimi Qwen GLM 谁更值得用?/)。
下期预告
AI 双周速递·第三期将重点关注:DeepSeek V4-Pro 正式版(预计 8 月初发布,届时第一时间实测)、Qwen3.8-Max 开源后的本地部署体验,以及 8 月下旬可能出现的更多新应用。关注我们,不错过每一次重要更新。
追踪 AGI 新应用,探寻 AI 真善美。 觉得有用,欢迎在评论区聊聊你最想了解哪个 AI 工具,我们下期安排!
本博客所有文章除特别声明外,均采用 CC BY-NC-SA 4.0 许可协议。转载请注明来源 AIJVS!
评论
