LG AI 研究院 7 月 31 日在 Hugging Face 上正式发布 K-EXAONE 2.0 模型,这是韩国科技信息通信部主权人工智能基金会模型项目下开发的第二代产品。新模型采用混合注意力 MoE 架构,拥有 7500 亿总参数和 370 亿激活参数,规模是初代的 3 倍以上,也是韩国迄今为止开发的最大人工智能基础模型。
值得一提的是,K-EXAONE 2.0 以 Apache 2.0 许可证完全开源,这在韩国 AI 发展史上颇为罕见。

纵向对比,K-EXAONE 2.0 在 24 项基准测试中平均得分 70.1 分,比初代的 63.3 分提升超过 10%,三大编码和智能体编码基准测试中性能改进约 30%。横向来看更是野心勃勃——在长上下文理解方面优于智谱 GLM-5.1,在智能体工具使用能力上同样超越 GLM-5.1 和 Qwen3.5,在指令执行评估中则与 GLM-5.1、DeepSeek V4 Pro Max、Qwen3.5 等处于同一水平。
从初代到 2.0,LG AI 研究院仅用一代就将模型参数规模翻了三倍多,且在多项关键指标上直接对标中国头部开源模型。在 Kimi K3 引发的全球开源模型竞赛尚未降温之际,韩国以主权 AI 之名加入战局,意味着东亚 AI 开源生态的三角竞争格局正在成型。
DeepSeek V4正式版自7月中旬灰度测试后一度跳票,官方至今未公布发布时间。但硅基流动平台通知自8月3日起,将DeepSeek V4 Pro的缓存命中价格从每百万Token 0.1元大幅上调至1.0元。这一突兀涨价被外界视为DeepSeek V4正式版即将上线的重要信号,8月3日或成为发布节点。
国产大模型全球下载量破100亿次,万亿级开源模型频出,人工智能产业链整体突破。国家发改委表示,上半年我国AI自主创新加速,深度求索、月之暗面等发布万亿参数开源大模型,下一步将统筹高质量发展与高水平安全。
科技圈迎来效率革命,字节跳动旗下Seed团队发布Seedance2.5音视频联合生成模型,主打一镜成片。单次生成时长从15秒延至30秒,并支持多轮无缝延长,让复杂情节更连贯。模型深度优化材质、光影与肤质,有效消除塑料感,实现逼真实拍质感,赋能多个产业场景。
7月31日,DeepSeek-V4-Flash正式版API上线。该模型Agent性能逆袭Pro版,打破以往强弱分层逻辑。总参数2840亿,在Terminal Bench2.1等基准测试中斩获高分。此举标志国产大模型在Agent赛道迈出关键一步。
阿里发布语音识别大模型Qwen-Audio-3.0-ASR-Flash,专注精准识别专业词汇。模型优化上下文一致性、行业词与热词定制,支持语音润色并直接输出结构化文本。团队构建了覆盖医疗、IT、股票等领域的多行业高质量词库,评测显示行业词识别效果显著提升。

关注 “悠AI” 更多干货技巧行业动态