DeepSeek V4 正式版自 7 月中旬开启灰度测试后一度跳票,官方至今未公布确切发布时间。但多个新证据指向 8 月 3 日可能成为重要节点——硅基流动率先露出马脚。
该平台发布通知称,将于 8 月 3 日起将 DeepSeek V4 Pro 大模型的缓存命中价格从当前每百万 Token 0.1 元大幅上调至 1.0 元。如此突兀的涨价,最合理的解释只有 DeepSeek V4 正式版即将上线,否则很难解释硅基流动的动机。

API 提前"变聪明",服务频繁波动佐证灰度测试
另一关键信号来自开发者社区的实测验证。多名网友发现,部分 DeepSeek V4 相关 API 已能正确回答此前在不联网状态下无法答对的 Claude Opus 4.5、Sonnet 4.5 等模型发布日期。测试均通过 API 而非网页对话进行,且并非所有用户都能复现,这正是灰度测试分批放量的典型特征。
近期 DeepSeek 服务频繁出现不稳定情况,也从侧面印证了团队正不断小范围测试并撤回修改,为全面推送打磨稳定性。从 7 月中旬至今,一个月的时间里 DeepSeek 持续迭代,外界期待正式版的性能至少能达到 GLM 5.2 与 Claude Opus 4.8 之间的水平。
对手没闲着:OpenAI 降价 80%,GLM 反涨价
DeepSeek V4 的压力不仅来自技术层面。OpenAI 今日宣布 GPT-5.6 系列降价高达 80%,降价后的性价比直追 DeepSeek V4 Pro,再叠加多模态等优势,当前性价比最高的模型头衔已被 OpenAI 夺走。反观国内,GLM 最新订阅价格大涨 2 至 3 倍,反而让 GPT 的性价比优势更加凸显。在对手一边降价抢市场、一边涨价提营收的分化格局下,DeepSeek V4 能否用性能扳回一局,8 月 3 日或将给出第一份答卷。
国产大模型全球下载量破100亿次,万亿级开源模型频出,人工智能产业链整体突破。国家发改委表示,上半年我国AI自主创新加速,深度求索、月之暗面等发布万亿参数开源大模型,下一步将统筹高质量发展与高水平安全。
科技圈迎来效率革命,字节跳动旗下Seed团队发布Seedance2.5音视频联合生成模型,主打一镜成片。单次生成时长从15秒延至30秒,并支持多轮无缝延长,让复杂情节更连贯。模型深度优化材质、光影与肤质,有效消除塑料感,实现逼真实拍质感,赋能多个产业场景。
LG AI研究院7月31日在Hugging Face发布K-EXAONE 2.0模型,为韩国主权AI项目第二代。采用混合注意力MoE架构,总参数7500亿、激活参数370亿,规模是初代3倍以上,系韩国最大AI基础模型。模型以Apache 2.0完全开源,在韩国AI发展史中颇为罕见。
7月31日,DeepSeek-V4-Flash正式版API上线。该模型Agent性能逆袭Pro版,打破以往强弱分层逻辑。总参数2840亿,在Terminal Bench2.1等基准测试中斩获高分。此举标志国产大模型在Agent赛道迈出关键一步。
阿里发布语音识别大模型Qwen-Audio-3.0-ASR-Flash,专注精准识别专业词汇。模型优化上下文一致性、行业词与热词定制,支持语音润色并直接输出结构化文本。团队构建了覆盖医疗、IT、股票等领域的多行业高质量词库,评测显示行业词识别效果显著提升。

关注 “悠AI” 更多干货技巧行业动态