国产大模型密集发布:DeepSeek V4 Pro、GLM-5.3与Qwen3.8 Max三天内同台竞技

2026年8月中旬,国产大模型行业进入密集发布期。DeepSeek V4 Pro正式版、智谱GLM-5.3、阿里Qwen3.8 Max在三天内相继发布,三款模型分别从Agent能力、后训练Scaling和开放权重三个方向推动技术边界。同期,国家超算互联网同步上线DeepSeek V4 Pro和Harness框架,苹果携手阿里训练中国专属大模型,OpenAI年化营收突破400亿美元,人工智能行业竞争格局正在加速分化。

DeepSeek V4 Pro正式版发布:Agent能力比肩Claude

8月13日凌晨,DeepSeek官网API文档页面悄然更新,V4 Pro模型版本号从预览版变更为DeepSeek-V4-Pro-0813。没有发布会预热,没有倒计时海报,DeepSeek延续了其一贯的技术驱动发布节奏。

核心变化在于Agent评测成绩的大幅跃升。在Terminal Bench 2.1测试集上,V4 Pro正式版得分较预览版提升约50分,性能比肩Claude Fable 5。Terminal Bench是评估大模型自主终端操作能力的权威基准,涵盖代码编写、调试、文件操作、系统管理等复杂多步骤任务。V4 Pro在该测试集上的表现标志着国产模型在Agent(智能体)领域首次达到国际第一梯队水平。

API定价方面,V4 Pro正式版兼容OpenAI和Anthropic双生态接口,一套代码可同时适配三家API。DeepSeek官方预告8月17日起上调云端API调用价格,推动企业加快私有化本地部署。国产AI模型从低价竞争转向价值竞争的趋势越发明确。

DeepSeek Harness智能体框架开源:一切皆插件架构

与V4 Pro同步发布的是DeepSeek Harness智能体开发框架,以MIT协议开源。Harness采用”一切皆插件”的架构理念,基于Cordite运行时实现复杂任务自动拆解、多工具协同调度。该框架定位为国产AI Agent底层工具链,填补了国内在Agent编排框架领域的空白。

8月14日,国家超算互联网宣布上线DeepSeek V4 Pro正式版和Harness框架。作为全国首个十万卡级超智融合算力资源池,国家超算互联网为科研院所和企业提供从训练、微调、评测到部署的全生命周期算力支撑。国家级算力平台与开源模型的结合,降低了企业使用前沿模型的门槛。

智谱GLM-5.3发布:后训练Scaling突破智能上界

8月14日,智谱正式发布GLM-5.3。与GLM-5.2相比,基座模型未变,总参数规模7530亿,但通过极致的后训练Scaling大幅提升了模型的智能上界。后训练阶段使用了数十倍于GLM-5.2的长程任务环境、更丰富的环境类型和超长训练时间。

编程能力方面,GLM-5.3在内部自建体感评测中较GLM-5.2提升50%,在Terminal Bench 3.0和Agents’ Last Exam (CLI)公开基准测试中取得开源模型第一。网络安全能力是GLM-5.3的重点突破方向,在部分安全任务中追平甚至超过海外闭源前沿模型。智谱同步启动”开源的盾”计划,将安全能力以开源方式提供给开发者。

智谱相关负责人表示:”当最强的矛被锁在少数人手里,最好的盾必须属于所有人。”7月,一台位于巴西的临时文件服务器进入GLM-5.3首批合作伙伴FOFA的追踪分析视野,验证了模型在跨国安全威胁情报领域的实战能力。

阿里Qwen3.8 Max:2.4万亿参数开放权重

在DeepSeek和智谱发布的同时,阿里通义千问发布Qwen3.8 Max,总参数达到2.4万亿(2.4T),并开放模型权重。三家头部厂商在三天内密集发布,编程能力和Agent(智能体)能力成为新一轮竞争焦点。此前Kimi K3也已在7月发布,国产开源大模型竞争持续升温。

三款模型的发布路径各有侧重:DeepSeek聚焦Agent能力和生态兼容,GLM-5.3强调后训练Scaling和安全能力,Qwen3.8 Max以超大参数规模和开放权重为差异化。这种多维度竞争推动国产模型从单一的性能比拼转向场景化能力构建,企业用户可以根据Agent编排、代码生成、安全分析等具体需求选择模型。

行业动态:苹果阿里合作与谷歌Gemini 3.7 Flash发布

模型产品层面,谷歌推出Gemini 3.7 Flash,面向低延迟场景优化。OpenAI年化营收突破400亿美元,但高管连续离职给IPO前景蒙上阴影。产业层面,苹果携手阿里训练中国专属大模型,适配中国市场合规需求和本地化场景。高盛洽谈参与英伟达5000亿美元AI融资计划,算力基础设施投资持续加码。

江苏印发商业航天三年行动计划,推进太空计算全链条降本。广州海珠区发布”词元八条”支持词元经济发展,地方政府对AI产业的政策支持从算力补贴向应用生态延伸。

腾讯Q2财报:千亿算力投入与AI商业化拐点

8月12日,腾讯披露2026年第二季度财报。Non-IFRS经营利润756.4亿元,同比增长9%。若剔除新AI产品(以混元、元宝、CodeBuddy、WorkBuddy及小微为主)的收入、成本及开支影响,经营利润增速更高。腾讯AI进入重兵投入阶段,单季度资本开支达528亿元,自由现金流转负。

千亿级算力投入正在改变互联网巨头的财务结构。腾讯的案例反映了头部厂商从观望转向全面押注AI的战略转向。AI产品对营收的贡献仍在早期阶段,但研发和算力投入已对短期利润率产生实质影响。资本市场的关注点从AI收入增速转向AI投入产出比和商业化路径。

硬件安全领域:Trezor钱包数据泄露事件

加密货币硬件钱包厂商Trezor披露数据泄露事件。其物流供应商发生安全事故,导致11742名购买安全设备的用户姓名、地址、电话号码和电子邮件地址被曝光,另有1947名客户的姓名、所在城市和电子邮件信息遭窃取。受影响用户分布于美国、英国、瑞典、哥伦比亚、巴西、意大利和葡萄牙。

硬件钱包本应是加密资产安全的最后一道防线,但供应链环节的数据泄露暴露了物理设备分发过程中的隐私风险。该事件提醒物联网和硬件安全领域,产品安全不仅涉及设备本身的加密能力,还涵盖物流、仓储等供应链各环节的数据保护。

竞争格局展望:从模型能力到生态构建

三天内三款大模型密集发布,标志着国产AI行业进入新阶段。技术层面,Agent能力、后训练Scaling和超大参数开放权重三条技术路线并行发展,尚未出现明显收敛。市场层面,DeepSeek的API提价和腾讯的千亿投入表明行业正从免费试用向商业化过渡。政策层面,国家超算互联网上线开源模型和地方政府AI扶持政策,构建了从算力基础设施到应用推广的完整支持体系。

对开发者和企业而言,模型选择不再是单一的性能排名比较,而是需要综合考虑Agent编排能力(DeepSeek Harness)、安全场景适配(GLM-5.3″开源的盾”)、参数规模与本地部署可行性(Qwen3.8 Max开放权重)等多维度因素。国产开源模型的快速迭代也为私有化部署提供了可行路径,DeepSeek预告的API涨价进一步强化了这一趋势。

原创文章,作者:小编,如若转载,请注明出处:https://www.yunthe.com/guo-chan-da-mo-xing-mi-ji-fa-bu-deepseekv4pro-glm53-yu/

(0)
小编小编
上一篇 7小时前
下一篇 7小时前

相关推荐