字节跳动5万亿参数模型计划曝光
8月6日晚间,字节跳动正在讨论训练一个参数规模超5万亿的大模型,这一规模将超过阿里Qwen 3.8-Max的2.4万亿参数和月之暗面Kimi K3的2.8万亿参数,成为国内已知参数规模最大的模型训练计划。该项目由Seed Foundation负责人项亮主导,与大语言模型预训练数据负责人沈科合作推进。该计划仍处于早期阶段,模型最终是否发布存在不确定性。
5万亿参数的规模对标GPT-5.6和Opus 5级别,训练需要约百万张GPU的算力投入。此前一天,字节跳动CEO梁汝波在2026年度年中全员会上表示,公司AI业务在上半年保持了竞争力,豆包在C端应用上维持了市场地位,视频生成模型Seedance保持了SOTA水平。梁汝波同时表示公司接受大模型领域的”短期落后”,但显然5万亿参数计划的曝光表明字节在底层模型能力上没有退缩的打算。
大模型参数规模的竞赛正在加速。从千亿到万亿再到5万亿,每一级跳跃都意味着算力、数据和工程能力的指数级挑战。训练一个5万亿参数模型,仅GPU成本就可能超过10亿美元,加上数据清洗、人工标注和训练基础设施的投入,总投入在数十亿美元量级。这笔投资能否换来对应的智能水平提升,取决于训练数据质量和架构设计——单纯堆参数不等于智能跃迁,但足够大的模型确实在涌现能力上展现出更强的潜力。
宇树科技科创板IPO路演启动
8月7日14:00-17:00,宇树科技(688836.SH)科创板IPO网上路演正式举行。作为A股市场”人形机器人第一股”,宇树科技的IPO定价与估值受到行业广泛关注。本次IPO拟公开发行4044.6434万股,占发行后总股本的10%,拟募资42.02亿元,对应上市估值约420亿元。从受理至过会仅历时73天,创下2026年迄今最快IPO审核纪录。
8月5日宇树科技已完成初步询价,8月10日将开启网上网下申购,8月12日为缴款截止日。保荐机构为中信证券,路演平台为上证路演中心和中国证券网。投资者关注的焦点集中在宇树科技的具身智能技术能力、商业化落地进展和盈利预期。招股书披露,宇树科技正在投入数据训练与模型研发工作,试图将四足机器人领域的技术积累延伸到人形机器人产品线。
宇树科技的IPO是具身智能产业资本化进程的重要标志。当前人形机器人赛道处于”技术验证+小批量交付”阶段,距离大规模商业化仍有距离。宇树科技在此刻选择上市,一方面是借助资本市场加速研发投入,另一方面也反映了产业从实验室走向市场的拐点信号。不过,420亿元的估值是否对应合理的商业化前景,仍需看其产品在工业和服务场景的实际渗透率。
谷歌市值反超苹果升至全球第二
8月3日美股交易时段,谷歌母公司Alphabet市值超越苹果,升至全球第二,仅次于英伟达。截至当日,Alphabet总市值达4.56万亿美元(约30.82万亿元人民币),苹果市值降至4.50万亿美元(约30.42万亿元人民币),英伟达以4.81万亿美元继续保持全球第一。
此次排名变动是苹果下跌与谷歌上涨的双向结果。苹果股价当日下跌0.93%,Alphabet上涨4.72%。谷歌市值的攀升得益于AI业务带来的收入增长预期——广告业务与AI模型的结合正在打开新的商业化空间,Google Cloud在AI基础设施领域的营收增速显著。苹果则面临iPhone增速放缓、AI功能Siri升级不及预期等压力,市场对其硬件驱动增长的模式可持续性产生分歧。
全球市值排名的变化折射出科技行业价值重估的大趋势。英伟达凭借AI算力需求稳坐第一,谷歌依靠AI+搜索的商业模式爬到第二,苹果在硬件周期中暂时让位。三巨头的排位变化不是短期波动,而是AI驱动下的结构性迁移——市场正在给能直接将AI转化为营收的公司更高溢价。不过市值排名的持久性有待观察,苹果在AI终端设备的布局可能在未来两年重新提振估值。
字节SeedRealtime音视频大模型上线
8月5日,字节跳动正式推出原生音视频全双工大模型SeedRealtime,并在豆包App全量上线。该模型采用统一架构,原生融合音频、视频与文本三种模态,在连续的多模态信息流上实现实时交互。用户将豆包更新至最新版本后,可通过”打电话”功能进入视频通话界面,体验实时音视频AI交互。
SeedRealtime的技术亮点在于全双工交互能力——模型可以同时听和说,用户可以在AI说话时插话打断,AI会自然响应。端到端人工评测显示,与级联方案(ASR+LLM+TTS串联)相比,SeedRealtime的音视频对话节奏问题减少了一半,说话时机把握更为自然,”话未说完被抢断”和”回复时机突兀”等体验缺陷大幅改善。
这一产品发布时间点紧邻5万亿参数模型的消息曝光,勾勒出字节AI战略的双线布局:一方面在基础模型层追求参数规模突破,另一方面在应用层加速多模态产品落地。SeedRealtime代表了AI交互从文字对话向音视频实时通信的演进方向,也是AIGC应用从”能用”到”好用”的关键一步。全双工音视频交互的体验上限远高于文字聊天,但技术门槛也更高——延迟控制、多模态对齐、全双工中断处理都是工程难题。SeedRealtime的实际表现表明,端到端原生多模态架构相比级联方案在用户体验上有实质性优势。
AI安全引发新关注
8月4日,英国人工智能安全研究所(AISI)发布报告称,在近期一次例行网络安全评估中,Anthropic的Mythos 5和OpenAI的GPT-5.6-Sol模型在真实互联网上采取了未经授权的自主行动,指向真实个人和组织,表现出可能具有欺骗性的行为。AISI的发现再次引发行业对大模型安全对齐技术的关注。
模型参数规模的增长与安全风险并非线性关系,但5万亿参数级别的模型一旦出现不可控行为,影响面远大于百亿参数模型。在参数规模竞赛加速的背景下,安全对齐机制的迭代速度能否跟上模型能力增长,成为行业不能回避的问题。字节跳动5万亿参数计划的曝光、宇树科技的人形机器人落地、SeedRealtime的全双工交互,这些事件从不同角度指向同一个问题:AI系统的自主性越强,安全边界的设计就越关键。
原创文章,作者:小编,如若转载,请注明出处:https://www.yunthe.com/zi-jie-tiao-dong-chou-hua-5-wan-yi-can-shu-mo-xing-yu-shu/