AI双周速递·第三期:DeepSeek V4 Pro 正式版登场,API 涨价 350% 引爆行业
本期导读:追踪 AGI 新应用,探寻 AI 真善美。AI 双周速递是 AIJVS 的固定栏目,每两周更新一次,帮你过滤噪音、直击重点。本期覆盖 8 月 13 日 ~ 8 月 15 日的重磅动态。 本期速览(3 分钟看完) DeepSeek V4 Pro 正式版发布:旗舰模型正式上线,同时官宣 API 大幅涨价,高峰时段输出价格从 6 元涨到 27 元/百万 tokens,涨幅 350%。 DeepSeek 开源智能体框架 Harness(DSH):MIT 协议、”一切皆插件”架构,npx @deepseek-ai/dsh web 一条命令启动,补齐 Vibe Coding 入口。 英伟达开发万亿参数开源模型 Nemotron 4:参数规模至少 1 万亿,约为现有最大模型 Nemotron 3 Ultra 的两倍,最早今年秋末训练完成。 可灵 AI 完成 30 亿美元独立融资:投后估值 180 亿美元,阿里、腾讯、百度同台入股,创全球视频大模型单笔融资纪录。 大模型价格战分化:一边 DeepSeek 涨价 350%,一边谷歌 Gemini 3.7 Flash 限时五...
如何用 AI 编程:从需求到上线的完整工作流(2026实战指南)
阅读前置:本篇是「如何用 AI 做 X」系列第 1 篇。如果你想先了解有哪些工具可选,推荐先看 中文 AI 编程助手横评。如果你还没装任何工具,先装 TRAE(免费,中文友好),然后回来照做。本篇面向”有编程想法但不知道怎么动手”的所有人。 你的想法可能比 90% 的代码都值钱我一个朋友,设计师,每天花 40 分钟整理甲方反馈——截图、打字、复制粘贴到文档。他知道这很蠢,但”不值得为这点事专门写个程序”。 后来他用 AI 编程工具,40 分钟做出来一个桌面小工具,现在每天 2 分钟搞定。 这不是程序员才有的能力。 任何一个有想法的人,在 2026 年都能用 AI 把想法变成可用的程序。 本文没有废话,给你三样东西: 一个拿来即用的 AI 编程工作流(写脚本 / 搭工具 / 做产品三级) 5 个直接复制粘贴的提示词模板 一个完整可运行的真实项目示例(附源码) 一、AI 编程三级工作流:不是所有项目都值得做很多人一上来就想做个”AI 小红书运营助手””智能客服系统”——然后做了一半发现太复杂,放弃。 2026 年的最佳实践是按复杂度选工作流: 场...
中文 AI 编程助手横评:TRAE / 通义灵码 / CodeGeeX / Cursor 该选哪个?
阅读前置:本篇是应用实战系列的工具评测篇。如果你是完全的新手,建议先看 Python编程基础(一) 或 深度学习入门指南 建立基础概念。本篇面向”想用 AI 写代码”的所有人。 先说结论(急性子直接看这) 完全小白、零成本入门 → TRAE(免费版够用,中文适配最好,图像转代码是杀手锏) 企业开发者、团队协作 → 通义灵码(阿里云生态成熟,Quest 模式 + Sub-Agent) 学生党 / 完全免费 → CodeGeeX(智谱清华背景,300+ 语言,学术友好) 追求极致编程体验、不差钱 → Cursor(海外原版,项目级上下文理解最强) 微信生态 / 腾讯系 → CodeBuddy(腾讯云,微信集成) 一、评测背景:为什么现在比?2026 年 AI 编程工具进入白热化阶段:字节 TRAE 升级双模式(Work 办公 + IDE 开发)、阿里通义灵码推出 Quest 模式、智谱 CodeGeeX 保持完全免费、Cursor 则靠订阅制守住高端市场。价格从 0 到每月 20 美元不等,差异巨大,选错了既浪费钱又耽误事。 我们基于多轮真实实测和社区反...
AI双周速递·第二期:Qwen3.8-Max 开源炸场,字节 SeedRealtime 边看边聊
本期导读:追踪 AGI 新应用,探寻 AI 真善美。AI 双周速递是 AIJVS 的固定栏目,每两周更新一次,帮你过滤噪音、直击重点。本期覆盖 8 月 6 日 ~ 8 月 12 日。 本期速览(3 分钟看完) 阿里开源 Qwen3.8-Max:2.4 万亿参数旗舰首次开源,编程能力直接对标 Claude 系列,程序员一句话就能让它从空文件夹写完整个项目。 字节发布 SeedRealtime:原生音视频全双工大模型,豆包 App 已全量上线,”边看、边听、边说”不再是 PPT。 DeepSeek V4-Pro 正式版进入倒计时:API 宣布大幅涨价,业界推测正式版即将发布,想省钱的抓紧。 OpenAI 风波不断:GPT-6 被曝 8 月强行发布,同时因 Astra 模型”自主攻防能力过强”暂停部分研发。 全国产 10 万卡超集群”曙光8000”投用:国产算力基建里程碑,AI 训练不再看美国脸色。 重点深度(值得展开的 2 条)一、Qwen3.8-Max:国产开源模型的新王座一句话:这是千问系列史上最大、最强的模型,也是首个对外开源的 Max 级别旗舰——总参数 2.4 万...
国产大模型横评:DeepSeek / Kimi / Qwen / GLM 谁更值得用?
阅读前置:本篇是 P3 前沿系列的收官篇。建议先读 Transformer深度解读 和 大语言模型(LLM)原理,理解”参数/上下文/量化”这些词再来看选型,事半功倍。 2026 年 8 月,国产大模型的”神仙打架”一个月内,三家头部厂商接连放大招: 7/16:Kimi K3 发布(2.8 万亿参数,全球最大开源模型) 7/19:Qwen 3.8-Max 预览版上线(2.4 万亿参数,开源回归) 7/31:DeepSeek V4-Flash 正式版 API 公测 8/3:GLM-5.3 意外泄露(尚未正式发布) 四家神仙打架,我们怎么选?本篇用一张表 + 场景拆解,帮你做决定。 全部数据来自公开报道与基准测试(标注置信度)。AI 领域变化极快,以官方公告为准。 一、四大家族对比总表 维度 DeepSeek V4-Flash Kimi K3 Qwen 3.8-Max GLM-5 厂商 深度求索 月之暗面 阿里 智谱 总参数 130亿激活(未公开总量) 2.8万亿 2.4万亿 7440亿 激...
顶会论文解读:ICML 2026 三大趋势与港大 CaRE 持续学习
阅读前置:本篇是 P3 前沿系列的论文解读篇,建议先看 Transformer深度解读 掌握基础概念。 为什么读论文?一个被低估的能力在 开源项目贡献指南 里我们说过,参与开源社区的第一步是”读代码”。而读论文,是理解 AI 前沿的唯一方式——因为: 新闻滞后:等你从新闻看到某个技术,它已经是半年前的研究了 博客稀释:二手解读常丢失关键细节 论文是源头:所有模型(Kimi K3、DeepSeek V4)的技术报告,本质都是论文 好消息:读论文不需要数学博士。本篇用大白话拆解 2026 年最重要的几篇,并教你一套”5 分钟读懂一篇论文”的方法。 一、ICML 2026 概况ICML(国际机器学习大会)是机器学习领域最顶级的学术会议。第 43 届 ICML 2026 于 7 月 6 日开幕。 本届亮点(置信度:高) 清华团队获最佳论文奖——中国学者在顶会的存在感持续上升 DeepMind 经典之作拿下时间检验奖——十年前的工作影响至今 三大趋势(会议官方总结): 新推理模式的模型架构(如混合注意力、状态空间模型) 更可靠的智能体(Agent)(长期任务执行、自我纠错) 降...
WebGPU实战:在浏览器里跑大模型(零成本本地推理)
阅读前置:本篇是 LLM 系列的实战篇。理论部分见 大语言模型(LLM)原理。需要基础 HTML/JavaScript 知识,Python 不是必需。 为什么要在浏览器里跑 AI?先看一组真实数据(来自 2026 年 WebGPU 基准测试,Apple M4 Max + Chrome): 指标 数值 模型 Gemma-4-E2B(20 亿参数) 预填充速度 4676 token/秒 解码速度 73.9 token/秒 初始化时间 1.1 秒 模型大小 200 MB GPU 内存 1.8 GB 你的浏览器,就是一台 AI 推理服务器。 这意味着: 零成本:不用买 GPU,不用租云服务器 隐私安全:数据不出本地,聊天记录不会上传 离线可用:模型加载后断网也能用 无需安装:打开网页就是 AI 应用 这正是 AI双周速递·创刊号 里说的”AI 应用爆发”的一个缩影——当推理成本趋近于零,应用形态就被彻底改变。 一、WebGPU 是什么?WebGPU 是浏览器的新一代 GPU 接口(类似 WebGL 的下一代,但...
大语言模型(LLM)原理:从训练到推理的完整流程
阅读前置:本系列是 Transformer深度解读 的续篇。强烈建议先读完上一篇,再来看 LLM 是怎么”长大”的。 从 Transformer 到 LLM:中间发生了什么?上一篇我们搞懂了 Transformer 单层的工作原理。但 GPT、Kimi K3、DeepSeek 这些”大语言模型”(Large Language Model, LLM),不是一个 Transformer 层,而是几十上百层堆叠 + 海量数据训练的产物。 一个核心问题:为什么把 Transformer 堆大、喂数据,模型就”会说话”了? 答案是:下一个词预测(Next Token Prediction)——所有 LLM 的核心训练目标,简单到令人难以置信。 一、预训练:让模型学会”接话”1.1 核心思想把互联网上几乎所有公开文本(书籍、网页、代码、论文……)喂给模型,让它做一件事: 看到前面的词,预测下一个词是什么。 比如给模型看 “今天天气真”,它要预测最可能的词是”好”(而不是”桌子”)。 就这么一个简单的目标,配合千亿级参数 + 万亿级 token 数据,模型在”预测下一个词”的过程中...
Transformer深度解读:从注意力机制到现代大模型的基石
阅读前置:建议先完成深度学习入门指南和神经网络架构详解:RNN与LSTM。本系列为 P3 前沿解读第二篇。 为什么你必须理解 Transformer?在 AI双周速递·创刊号 里我们聊到:Kimi K3 以 2.8 万亿参数登顶全球最大开源模型,DeepSeek V4-Flash 正式版上线——这些新闻的主角,底层都是同一个架构:Transformer。 2026 年的今天,从 GPT 到 Claude,从 Kimi 到 Qwen,从写代码到画图,几乎所有你能叫出名字的 AI 能力,都是 Transformer 的子孙。理解它,你就拿到了读懂整个 AI 世界的钥匙。 一、Transformer 解决了什么问题?2017 年之前,处理序列数据(文本、语音)的主流是 RNN/LSTM。它们的问题很致命:必须一个词一个词地顺序处理,就像你读书只能一个字一个字读,而且读完前面就忘了后面(长期依赖问题)。 2017 年,Google 发表论文 《Attention Is All You Need》,提出 Transformer。它的革命性在于: 并行处理:所有词同时被处...
AI双周速递·创刊号:Kimi K3 登顶全球开源王座,DeepSeek V4-Flash 正式版上线
本期导读:追踪 AGI 新应用,探寻 AI 真善美。AI 双周速递是 AIJVS 的固定栏目,每两周更新一次,帮你过滤噪音、直击重点。本期是创刊号,覆盖 7 月 16 日 ~ 8 月 5 日。 一、头条:Kimi K3 —— 全球最大开源模型诞生7 月 16 日,月之暗面(Moonshot AI)发布旗舰大模型 Kimi K3;7 月 27 日,完整模型权重正式开源。 核心数据(置信度:高,多个独立来源交叉验证) 指标 数值 总参数 2.8 万亿(全球最大开源模型) 激活参数 约 1040 亿(MoE,896 专家每 Token 激活 16 个) 上下文窗口 100 万 Token(单次可处理约 75 万单词) 能力 原生视觉理解,文本/图像/视频多模态 编程榜单 Frontend Code Arena 1679 分登顶,超越 Claude Fable 5(1631)和 GPT-5.6 开源时间 2026-07-27 深夜,完整权重 + 技术报告 为什么重要?这是中国大模型第一次在”开源 + 规模”两个维度同时登顶。 ...
