7月31日,DeepSeek-V4-Flash正式版API悄然上线公测,标志着这家国产大模型公司在Agent赛道上迈出关键一步。与以往"Pro强、Flash弱"的分层逻辑不同,此次更新后,Flash正式版在多项Agent基准测试中的表现已逼近甚至超越三个月前的V4-Pro预览版。
官方数据显示,V4-Flash正式版在Terminal Bench2.1上取得82.7分,Cybergym达76.7分,Toolathlon verified为70.3分。值得注意的是,该模型总参数2840亿,激活参数仅130亿,与V4-Pro(激活490亿)相差近一个数量级。DeepSeek明确表示,此次更新"仅重新进行了后训练",模型结构完全不变。这意味着,通过训练方法和数据质量的优化,轻量模型在特定任务上正缩小与旗舰模型的差距。

此次升级的另一看点,是自研Agent框架DeepSeek Harness首次以正式命名亮相。同时,V4-Flash原生支持OpenAI力推的Responses API格式,并针对性适配Codex,开发者可低成本将OpenAI生态的Agent应用迁移至DeepSeek平台。
战略意图十分清晰:用高性价比的轻量模型切入Agent应用市场。Agent场景对推理速度和成本极度敏感,Flash的低价优势在反复调用工具的多轮任务中将形成显著竞争力。
此次发布距离DeepSeek完成超500亿元首轮融资不足两月,公司估值已攀升至约710亿美元。在资本加持下,DeepSeek正加速从"不融资不上市"转向商业化冲刺。随着Pro正式版即将到来,Agent战争的大幕已然拉开。
DeepSeek V4正式版自7月中旬灰度测试后一度跳票,官方至今未公布发布时间。但硅基流动平台通知自8月3日起,将DeepSeek V4 Pro的缓存命中价格从每百万Token 0.1元大幅上调至1.0元。这一突兀涨价被外界视为DeepSeek V4正式版即将上线的重要信号,8月3日或成为发布节点。
国产大模型全球下载量破100亿次,万亿级开源模型频出,人工智能产业链整体突破。国家发改委表示,上半年我国AI自主创新加速,深度求索、月之暗面等发布万亿参数开源大模型,下一步将统筹高质量发展与高水平安全。
科技圈迎来效率革命,字节跳动旗下Seed团队发布Seedance2.5音视频联合生成模型,主打一镜成片。单次生成时长从15秒延至30秒,并支持多轮无缝延长,让复杂情节更连贯。模型深度优化材质、光影与肤质,有效消除塑料感,实现逼真实拍质感,赋能多个产业场景。
LG AI研究院7月31日在Hugging Face发布K-EXAONE 2.0模型,为韩国主权AI项目第二代。采用混合注意力MoE架构,总参数7500亿、激活参数370亿,规模是初代3倍以上,系韩国最大AI基础模型。模型以Apache 2.0完全开源,在韩国AI发展史中颇为罕见。
阿里发布语音识别大模型Qwen-Audio-3.0-ASR-Flash,专注精准识别专业词汇。模型优化上下文一致性、行业词与热词定制,支持语音润色并直接输出结构化文本。团队构建了覆盖医疗、IT、股票等领域的多行业高质量词库,评测显示行业词识别效果显著提升。

关注 “悠AI” 更多干货技巧行业动态