作者|参商 西梅汁
编辑|星奈
媒体|AI大模型工场
国内大模型发展趋势|7月份解读
3万亿参数免费下!中国大模型掀翻“硅谷桌子”
刚刚过去的7月,中国大模型在全球AI圈投下了一颗重磅炸弹。
月之暗面正式发布新一代开源模型Kimi K3,总参数量达到2.8万亿,成为全球首个开源的3万亿级别模型。更让硅谷侧目的是,Kimi K3每项任务的平均成本仅约0.94美元,与GPT-5.6 Sol基本相当,却仅约为Claude Opus 4.8的一半。低成本叠加高性能的特性,也引发市场讨论,有观点认为或将改变海外资本市场对 AI 芯片与算力资产的估值逻辑。连特斯拉CEO马斯克都在相关评测下留言“Impressive”,这已是马斯克第二次公开认可Kimi。技术突破与成本优势的双重加持下,月之暗面估值飙升至350亿美元,并已启动赴港上市筹备。
紧随其后,阿里亮出最新进展。7月23日,阿里云官宣自研灵骏真武 M890 超节点完成对新一代大模型 Qwen3.8 的适配;千问团队预告 Qwen3.8 即将发布并开源,总参数量达 2.4 万亿。这套超节点是国内首个可稳定运行超 2 万亿参数大模型的算力集群。64张真武M890芯片以800GB/s高速互联,显存规模达9TB,单实例即可支撑大规模MoE模型的专家并行需求。这不仅在模型层面追赶,在底层算力架构上也实现了系统级突破,从单芯片性能比拼,迈入超节点算力协同的新阶段。
与此同时,DeepSeek的资本动作备受行业关注。7月中旬,DeepSeek正式启动IPO筹备工作,计划登陆科创板,最快今年提交申请、2027年挂牌。公司同时推进第二轮融资,投前估值高达710亿美元(约合人民币4800亿元),短短三个月内估值翻了约7倍。创始人梁文锋的净资产也随之暴涨至约360亿美元,登顶全球AI圈首富。算力饥渴与人才争夺,正在倒逼所有玩家加速资本化。
这场“掀桌子”的本质,这场行业变革的核心,不只是中国企业打造出规模更大的大模型,更是国内团队向全球开发者开放顶尖大模型权重,很大程度上降低高端大模型的落地门槛。权重开放不等于无条件免费商用,企业部署、商业化使用仍需要承担算力、授权等相关成本。
过去,行业更多是在追赶海外模型的性能指标;如今,竞争已经延伸到训练成本、推理效率、算力架构和融资能力。一家公司能否持续留在牌桌上,拼的不再只是模型本身,而是一整套从技术研发、算力供给到商业化和资本补给的系统能力。
芯片、软件栈、开源生态三线齐:发国产算力加速迈向系统级闭环
中国AI算力基础设施建设迎来了一轮集中爆发。
先看硬件端的硬核破局。中科曙光落成的 “曙光 8000”,是国内首个全国产十万卡 AI 超集群,集群建成后同步接入国家超算互联网。十万卡集群比拼的从来不是简单的芯片堆叠,而是超大规模节点通信互联、网络带宽、液冷散热等整套系统工程能力。
与此同时,华为昇腾 950 超节点真机在 WAIC 完成全球首秀,并斩获大会 SAIL 最高奖项,印证国产算力无论是单点硬件突破,还是整体系统架构设计,均迈入全球第一梯队。中国算力正在告别零散部署的 “单兵作战” 模式,加速织就 “全国一张网” 的一体化算力矩阵。
大模型厂商也不再甘心只做算力的租赁方,开始亲自下场建设自有算力底座。智谱落地 1GW 级全国产 AI 算力数据中心,同时斥资数亿元收购异构算力软件栈企业中科加禾。这一动作释放清晰行业信号:算力竞赛已经进入软硬协同的深水区。仅有国产硬件芯片远远不够,想要将异构算力转化为高效的模型训练生产力,核心依靠中间层软件栈。头部 AI 企业正着力搭建从底层芯片、算力中间件到上层大模型的全栈能力护城河,争夺算力调度与使用标准的主导权。
更值得关注的是生态竞争思路的升级。华为在 WAIC 展出昇腾 950 超节点算力底座之后,于 7 月 31 日正式开源 openPangu 大模型。这释放出的明确趋势:国产算力要构建的是繁荣开放的开源生态。硬核自主算力底座搭配开源大模型,能够持续降低全行业落地 AI 技术的门槛。
从十万卡级超集群落地,到 GW 级国产算力中心开工建设,叠加超节点硬件真机亮相、开源大模型持续释放,中国 AI 算力正加速从 “能用” 走向 “好用”,由单点技术突破,迈向系统级能力闭环。
大模型的百模大战或许会逐渐降温,但支撑这一切的算力底座之战才刚刚进入白热化。这只是序章,接下来,就看谁能在这片自主可控的算力高地上,长出真正世界级的AI超级应用了。
四大厂商同步整合AI 办公产品线,谁能掌握下一代工作入口?
眼下,国内AI办公赛道正式告别“内部赛马”的野蛮试错期,迎来巨头收编整合的决战拐点。
腾讯将QClaw团队并入口碑攀升的WorkBuddy;阿里把三款Agent产品整合为千问办公交由钉钉统管;“字节加速推进豆包与飞书深度融合,打造面向企业场景的 AI 办公能力”,沉寂已久的360也推出纳米Work,以赠送亿级Token的激进姿态抢食。优等生轮廓初显,意味着大厂对办公智能体的争夺,已从功能试错全面转向真刀真枪的商业博弈。
争夺下一代工作入口,本质是一场基于“生态与流量”的降维打击。在这场角逐中,各家的底牌差异显著。
比如,腾讯WorkBuddy的极强压迫感,源于微信难以迁移的社交关系链与真实工作语料;阿里试图依托钉钉庞大的B端协同网络重塑战场;字节则渴望借豆包的亿级C端流量池在企服赛道弯道超车。面对这些自带生态壁垒的超级智能体,传统协同办公软件正面临前所未有的“代际差”冲击,入口之争已彻底演变为底层生态的较量。
然而,跑马圈地之后,商业化变现的“深水区”挑战接踵而至。当前,无论是订阅制还是按Token计费,行业的定价策略仍在反复试探用户的底线,豆包专业版与飞书Aily的定价争议便是缩影。更核心的矛盾在于,办公平台始终在“服务海量用户”、“保持高频粘性”与“实现商业变现”这三个互斥目标间艰难平衡。即便飞书交出了ARR(年度经常性收入)翻倍的亮眼成绩,但对比巨头千亿级的AI资本开支,现有的变现模式仍难以撑起稳定的第二增长曲线。
随着市场集中度急剧攀升(头部三家已占据超90%的访问量份额),AI办公赛道的玩家阵营正加速分化。除了互联网巨头,金山办公等老牌厂商死守政企与文档原生优势,滴普科技等垂直玩家则深耕企业级业务流。
但无论何种流派,最终都要面对互联网产业的一条铁律:完成垄断,或许是解决盈利难题的唯一解药。从抢占流量入口到攫取垄断利润,这场刺刀见红的白刃战才刚刚开始,谁能率先跑通商业闭环,谁才能真正掌握下一代人机交互的工作入口。
国内大模型动态
字节跳动
7月31日,字节跳动正式发布新一代视频创作模型Seedance 2.5,Seedance 2.5延续了Seedance 2.0统一的多模态音视频联合生成架构,重点突破长叙事能力、多模态参考能力和编辑能力。
该模型单次可生成30秒高质量视频,并支持多轮延长,可生成数分钟连贯内容;多模态参考能力全面升级,支持单次输入最多30张图片、10段视频、10段音频作为参考;编辑能力进一步增强,支持时间戳控制,可定向编辑视频内容。模型正在陆续上线即梦AI、豆包专业版等平台,API 服务也将在近期上线火山方舟。
7月30日,字节跳动发布内部邮件,宣布飞书产品团队与豆包产品团队将整合,成立新的豆包产品团队,由豆包负责人赵祺负责,飞书负责人谢欣向赵祺汇报。这是字节跳动自2021年实行业务板块化以来,对To B业务最大的一次调整。
同时,飞书GTM与火山引擎整合,成立“创造力服务平台”,负责MaaS和SaaS的GTM。飞书产品保持不变,将与豆包在生产力场景深化协作,豆包企业版已在部分飞书客户内测。
7月23日,字节跳动Seed团队正式启动Seed STEM科学家计划,面向基础科研领域开放AI技术能力,探索大模型、智能体在生命科学、材料科学、物理学等方向的应用,推动AI for Science技术落地。
7月20日,字节跳动Seed团队正式发布音频创作模型Seed Audio 1.0,已上线火山方舟体验中心开放测试。该模型面向完整声音场景,在统一框架下联合建模人声、音效和环境声等多种音频要素,端到端完成影视级音频创作,支持20余种语种,在影视、短剧、动漫等九大类创作场景音频可用率超90%。标志着字节跳动在多模态AI布局上从文本、图像、视频向音频领域完成全模态覆盖。
7月17日至7月20日,2026世界人工智能大会期间,字节跳动与中兴努比亚联合打造的AI智能体手机NaviX Ultra正式亮相。产品深度集成豆包大模型与系统级智能体能力,机身专属AI键可一键唤起,跨应用完成多平台比价、打车、行程规划等复杂任务。字节跳动未独立参展WAIC,其AI能力通过合作终端、生态伙伴等形式广泛落地。
7月16日,字节跳动旗下Seedance 2.5视频生成模型API面向所有开发者正式全量开放,结束企业内测阶段。API全面开放文生视频、图生视频、多参考控制、局部编辑等核心能力,支持企业级高并发调用,深度适配AI短剧、品牌广告、数字人内容等工业化生产场景,是当前国内商用级视频模型的主流选择之一。
7月8日,字节跳动Seed团队正式发布Seedream 5.0 Pro图像生成模型。该版本从“内容生成工具”向“专业设计生产力工具”升级,新增可编辑图层、点选 / 套索选区精细编辑、10 +语言原生文字渲染等能力,支持品牌视觉规范固化,保障数十轮迭代后风格统一,适配商业海报、UI原型、电商素材等专业生产场景。
7月7日,字节跳动发布了用于衡量真实世界环境学习的超长程评测集 EdgeBench。该评测集包含134个真实且多样的任务,横跨六大能力领域,Agent 在每个任务上都可持续工作至少12小时。
基于这些任务上的长程环境交互运行结果,其发现Agent在“环境学习”过程中的整体表现遵循一条高精度的log-sigmoid曲线,平均拟合精度R²达到0.998。同时,从不同代际的前沿模型来看,Agent的学习速度大致呈现出每三个月翻一倍的趋势。目前,EdgeBench已开源其中51个任务及完整评测框架,供社区进一步研究Agent如何从真实世界环境中学习。
7月6日,字节跳动Seed团队研发的旗舰视频生成模型Seedance 2.5正式面向公众开放体验。该模型于2026火山引擎FORCE原动力大会首次发布,核心实现三项行业级突破:单段原生生成最长30秒4K分辨率视频,全程保持人物、场景一致性;支持最多50个全模态参考素材联合控制,可锁定角色形象、品牌色板与镜头语言;新增局部语义编辑功能,可单独调整背景、人物表情等局部元素,无需重渲全片。用户可通过即梦平台率先体验,模型于7月16日全量开放API。
腾讯
7月30日,腾讯WorkBuddy(V5.3.5版)联合腾讯文档正式推出面向Agent时代的“人机双写”协同编辑能力。用户可在WorkBuddy中直接与AI在同一份文档里共同创作、修改、实时协作。WorkBuddy支持框选即改(段落、表格、PPT页面、画布位置)直接下达指令,AI在指定范围内精准修改。该功能支持Word、Excel、PPT、Markdown等主流办公格式,兼容本地Office文件和腾讯文档,覆盖Win、Mac、鸿蒙、安卓等操作系统,并深度集成腾讯文档、腾讯会议、腾讯ima、TAPD等生态产品。
7月27日,腾讯WorkBuddy正式上架鸿蒙电脑应用市场,成为鸿蒙平台首个桌面办公智能体。本次发布为鸿蒙用户带来APP、PC全终端覆盖的一致性产品体验。
针对鸿蒙系统的原生适配需求,团队攻坚打通登录、电脑连接、连接器、技能、产物预览等关键链路,快速推动关键系统级权限适配落地。依托鸿蒙系统,WorkBuddy 全新升级「碰一碰」产物分享功能,基于鸿蒙手机“碰一碰”能力,不需要加微信,也不用扫码,就可以实现文件和对话内容的便捷分享,支持任务跨端接续执行。
7月23日,腾讯云正式发布云端研发智能体 CodeBuddy NPC。开发者只需派发一个任务,CodeBuddy NPC即可自主完成方案规划、代码开发、提交 PR、执行测试,并根据CI结果持续修改,直到交付可验收的成果。
该产品依托腾讯云研发平台CNB,可以直接利用代码仓库、Issue、PR、CI/CD 等研发上下文,在现有研发流程中持续推进任务,无需开发者反复复制需求、代码和报错日志,开发者可直接@触发任务。其支持多角色NPC组队协同,官方研发NPC经过持续优化,首轮Token消耗已从早期2万多个降低至约2000,降幅超过90%,企业无需改造现有工具链即可快速接入。
7月23日,腾讯宣布混元多模态模型部门与大语言模型部门合并,成立基础模型部,统一由腾讯首席AI科学家姚顺雨管理,以进一步提升模型研发和协同效率,探索全模态模型的智能上限。
7月22日,腾讯宣布Miora全量上线,Miora定位是一个有记忆、能理解需求、能调用多智能体(Agent)协作的AI创意智能体。用户仅需提出创作目标,系统即可自动拆解需求,并将图片、视频、3D、UI等工作交给对应的专家处理,输出多种成果,风格保持一致。
7月21日,腾讯混元宣布推出Hyra(Hunyuan Research Agent)首个版本Hyra-1.0。据腾讯混元介绍,这是一个能够递归自我改进、面向性能导向的研究与工程任务的智能体。除了模型研发与科学发现,Hyra还可以进入游戏、设计和内容创作等开放场景,根据自博弈、自评价和用户反馈持续迭代策略产物。
7月17日至7月20日,腾讯在2026WAIC集中发布AI全栈成果:混元Hy3上线一周调用量增长68倍,登顶OpenRouter全球大模型调用总榜;首次系统性亮相具身智能全栈方案,发布三大基座模型(Hy-Embodied-VLM-1.0、RxBrain-1.0、VLA-0.5);WorkBuddy独立App正式上线,成为国内首个覆盖iOS/安卓/鸿蒙三端的通用智能体应用;腾讯云ADP 4.0海外版同步上线,并联合信通院发布出海工具“AI航海家+”。腾讯集团副总裁李侃表示,AI正从工具变成伙伴,从“生成内容”走向“完成任务”。
7月15日,腾讯宣布元宝与京东AI Agent完成小程序生态打通,京东AI Agent由此成为元宝首个电商垂域合作伙伴。用户升级至最新版元宝并开启快速思考模式后,在对话中咨询商品信息、对比参数或查询价位时,系统将整合权威资讯与京东数据,以卡片形式展示全品类商品详情。点击即可跳转京东购物小程序,实现从"信息查询"到"下单履约"的无缝闭环。
7月6日,腾讯混元Hy3正式发布。相比preview版本,Hy3在软件开发、办公生产、金融建模、前端设计、游戏制作等生产力任务上显著跃升,以较小尺寸首次比肩国内外大尺寸旗舰模型效果。Hy3已在WorkBuddy/CodeBuddy、元宝、Marvis、ima等多个业务接入。在WorkBuddy办公场景的内部测评中,任务成功率从72%升至90%,平均耗时缩短34%。价格方面,Hy3定价为输入1元/百万tokens、输出4元/百万tokens,采用Apache2.0开源协议。
阿里巴巴
8月3日,阿里巴巴旗下企业级Agent产品“千问办公”(QwenWork)开启公测。个人和企业用户均可通过“千问办公”官网(qwenwork.cn)体验,目前网页版和独立PC客户端已开放,钉钉PC端和手机端内置入口近期也将开放。用户可在“千问办公”体验阿里最新旗舰模型Qwen3.8。
7月31日,千问已进入特斯拉中国车机的深度测试阶段,上车在即。千问目前已经在特斯拉真实车机环境下完成大量的上车测试工作,“能听能答、能控车、能导航、能办事,都已经在计划内”。未来,千问在特斯拉车机上能提供的能力,可能远超单一“语音助手”的定义。
2026 北京车展上,国内头部车企已经宣布纷纷接入千问,从披露的技术路线来看,千问上车至少具备三层能力:一是复杂语义与多任务路径规划;二是打通“点单—履约—支付”的办事闭环;三是端云协同架构下,覆盖内容、生活、交易全场景。
7月28日,阿里Qoder上线实时语音交互智能体Qoder Voice,由全双工语音模型Qwen-Audio-3.0-Realtime驱动。用户可随时语音唤醒智能体,通过语音下达指令、讨论方案,智能体实时响应并执行任务。
7月25日,阿里云千问AI平台升级Qwen3.7原生视觉语言系列Flash模型,相较3.6-Flash全面升级多模态理解与Agent执行能力,强化万物识别、真实世界感知与空间智能,Search/CI Agent更稳定。
7月24日,阿里云开源发布文档解析模型OvisOCR2,该模型以96.58的综合得分刷新OmniDocBench v1.6榜单纪录,成为首个超越流水线方法并登顶该榜单的端到端模型,这是文档解析领域迎来技术路线的重要突破。
该模型基于Qwen3.5-0.8B后训练得到,融合SFT、RL、OPD及模型融合四阶段训练方案。OvisOCR2还采用端到端技术路线,输入文档图像即可一次生成符合阅读顺序的Markdown输出,覆盖文本、公式、表格等多类内容。模型以Apache 2.0许可证开源,兼容vLLM等主流推理框架,可与Qwen3.5推理生态衔接。
7月23日,阿里云宣布灵骏真武M890超节点实例已成功适配Qwen3.8,并上线阿里云百炼平台提供模型推理服务,该超节点是国内首个成功运行超2万亿参数大模型的超节点。
7月22日,阿里即将推出的“千问办公”产品已在内部小范围测试,该产品定位独立于通义千问之外,主打深度办公场景的智能协作。另据了解,阿里千问办公产品已在全国公开招聘解决方案架构师、业务拓展专家、AI产品经理等岗位,有接近阿里人士告诉记者,千问办公产品或将于近期发布。
7月19日,千问大模型官方宣布,Qwen3.8很快将发布并开源,新模型参数2.4T,正在以"天"为单位持续进化。Qwen3.8-Max预览版已率先在阿里Token Plan、Qoder及QoderWork上线。消息发布后,阿里巴巴港股暴涨超5%,市场将其视为2026年AI军备竞赛进入“万亿参数”决胜时刻的信号。
7月18日,WAIC 2026首日,阿里云集中发布多项AI新品:发布智能体原生云理念及AgentTeams等企业级工具;推出灵骏真武M890超节点实例,单实例可承载十万亿参数级推理;ATH事业群发布企业级AI创作平台秒悟团队版;千问首款AI智能体耳机首次亮相;平头哥开源AI软件栈T-Head SAIL,平头哥真武芯片与阿里云磐久超节点服务器入选2026 WAIC“镇馆之宝”;并发布《AI Agent安全最佳实践》。
7月17日,阿里通义实验室正式发布全模态实时双工交互模型Wan-Streamer v0.2。该模型采用端到端原生架构,将 “听、看、说、演”能力整合进单个Transformer,打破传统流水线数字人系统延迟高、声画不同步的痛点。
新版模型含双向网络传输的端到端响应延迟550ms,输出分辨率从192×336大幅升级至640×368@25FPS,可呈现微表情、肢体手势与场景细节,原生支持音视频、文本的实时理解与同步生成。技术上采用Thinker-Performer双通路与Ulysses并行分布式架构,通过快慢通路时序重叠调度兼顾画质与响应速度,可广泛适配视频AI助手、沉浸式教育、游戏NPC、无障碍交互等多元场景。
蚂蚁集团
7月29日,媒体报道蚂蚁集团旗下子公司蚂蚁数科正在筹备 Pre-IPO 融资。同日,媒体报道称,蚂蚁旗下独立数据库公司OceanBase目前正在寻求A轮融资,加上此前已完成A轮融资的蚂蚁国际,蚂蚁集团已有三家子公司在推进独立融资。
公开数据显示,目前,蚂蚁数科与300余家合作伙伴一起服务了全球30000+家企业客户。
7月27日,蚂蚁百灵正式发布新一代原生混合推理模型Ling-3.0-Flash。该模型总参数量124B,单次计算激活5.1B参数,在基础推理、指令遵循及长文本处理等核心指标上对标甚至超越2-3倍体量的行业领先模型。模型针对Agent的实际应用场景进行了深度打磨,扩展了超10000个真实交互训练环境,并优化了复杂任务的自我纠错与长程规划机制。架构上采用混合注意力设计,以5:1比例交替堆叠KDA层与MLA层,每个Token的专家激活比例压缩至1/64。该模型已上线OpenRouter,限时免费一周,后续将正式开源。
7月21日,蚂蚁国际宣布完成约12亿美元A轮融资。本轮融资将用于扩展全球业务,加速AI等前沿技术投入,拓宽跨境支付、全球账户等普惠金融科技服务。蚂蚁国际2024年独立运营,业务覆盖亚洲、欧洲、中东和拉美等主要市场,已连接超1.5亿全球商户和逾20亿消费者账户。
7月17日至7月20日,蚂蚁集团在2026WAIC系统性展示三层AI布局:健康AI“阿福”用户破亿,日均处理超1000万次健康咨询;AI版支付宝“阿宝”上线公测,打造Agent超级入口;AI支付已支持3亿笔智能体交易,适配95%通用智能体框架;蚂蚁灵波智慧药房获评大会“镇馆之宝”;蚂蚁密算发布HOP 3.0架构,蚂蚁数科发布Agentar 2.0“商业智能体超级工厂”,预置近200个岗位级数字专家模板;蚂蚁联合20余家伙伴推动ASL智能体安全协议,并参与发布《智能体互联互通协同发展与治理倡议》。蚂蚁集团副总裁陈亮表示,信任风险正成为智能体规模化应用的核心瓶颈。
7月16日,蚂蚁集团旗下全模态AI助手「灵光App」已对其闪应用社区版块“灵光圈”进行功能升级。新版本不仅上线了“大家在玩”热榜、编辑精选、关注创作者等功能,更在PC端开放了文档、图片等多模态文件的上传与应用生成权限,用户可基于本地文件生成智能问答或创作AI应用,极大提升了AI应用的发现效率和创作体验。
据了解,灵光圈是灵光App面向用户开放的AI应用创作社区。用户通过发送文字、语音对话,即可生成轻量化、可交互的“闪应用”,并在灵光圈社区内进行发布、使用、收藏、评论、二次创作。此次升级围绕内容发现、创作者连接、应用创作三个维度展开。
7月14日,蚂蚁AI安全实验室近日宣布开源两款安全模型。多模态安全护栏SingGuard面向大模型服务场景,支持对文本、图片及图文组合内容进行统一安全判断,可识别隐藏在图片中的跨模态攻击,支持运行时动态加载自然语言安全规则,无需重新训练模型即可完成规则更新。智能体行为安全护栏SingGuard-NSFA聚焦AI自主执行场景,在智能体执行动作前完成实时检测,将风险细分为7大类185个具体场景,覆盖133种语言近10万条样本,单次判定约50毫秒,提供0.8B、2B、4B、9B四种模型规模。
7月10日,蚂蚁灵波正式推出业界首个具身原生世界动作模型LingBot-VA 2.0,标志着机器人基础模型从“基于数字世界模型构建”转向“面向物理世界原生设计”。该模型从零开始预训练,采用自回归架构、语义视觉-动作分词器、MoE架构及增强异步推理等核心设计,LingBot-VA 2.0给出了单卡150Hz实时推理效率的答卷,并完成与人类多轮随机对打等高动态交互任务。
本周,蚂蚁灵波已经连续发布和开源了多款模型,而LingBot-VA 2.0作为集大成者扮演了收官之作的角色,也正式开启了具身原生新阶段。
7月8日,蚂蚁灵波科技正式开源新一代具身基座模型LingBot-VLA 2.0。该模型预训练阶段融入6万小时高质量真实物理数据,覆盖17个主流机器人品牌的20种机器人构型,并扩展对头部、腰部、末端执行器及移动底盘等自由度的支持。在GM-100双臂评测及长程移动操作任务中,其性能领先π0.5与GR00T N1.7。本次同步开源高效后训练版本,推理耗时在RTX 4090上控制在130毫秒以内。模型已在零售分拣、物流、工业等场景启动商业落地测试。开发者可在Hugging Face、魔搭社区获取模型权重,在GitHub下载开源代码。
7月7日,支付宝AI开放平台正式上线,面向企业开发者、代开发服务商开放邀测。通过支付宝AI开放平台,商家、机构可便捷完成服务能力的AI化升级,不仅可接入“阿宝”,为10亿用户提供智能服务,同时,也可选择跨端互联,通过“阿宝”接入手机、车机、AI 眼镜、IoT等智能终端和大模型平台,实现“一次接入,多端分发,统一管理”。
7月2日,灵光一号位寒洛调任健康AI“阿福”,原班人马部分抽调入垂直赛道。这一系列调整标志着蚂蚁AI战略从原先“全模态通用AI”与“健康垂直模型”双线并进的格局,转向以阿福为战略重心的单点聚焦。
同日,AI版支付宝“阿宝”完成新一轮迭代并开放公测,iOS与安卓用户可在应用商店或支付宝App内搜索“阿宝”或“蚂蚁阿宝”更新体验。作为面向生活服务的办事型AI,“阿宝”定位并非单纯问答,而是通过自然对话把用户意图匹配到具体服务,完成查询、办理、领券、购物、规划等动作。公测首批精选72项智能办事技能,覆盖居家打理、交通出行、优惠采购、政务证件、钱包账单、陪伴互动等场景,用户一句话即可调用,降低新界面上手门槛。
月之暗面
7月29日,月之暗面kimi已完成F轮融资,融资金额超35亿美元,投后估值涨至350亿美元。因超目标金额3倍多,本轮融资系提前关闭,原定8月开始的G轮(Pre IPO轮)已提前开始,投前估值升至500亿美元。
7月28日,月之暗面Kimi正式开源Kimi K3完整模型权重,为全球首个落地的3万亿参数级开源大模型。据第三方平台Artificial Analysis数据显示,K3在保持第一梯队性能的同时,BrowseComp基准单次任务成本仅为GPT-5.6 Sol的一半,较Claude Fable 5便宜近一个数量级。月之暗面称每个人都可以下载并部署Kimi K3模型,无论是用于内部研发,还是嵌入到面向终端用户的产品中,均可自由使用。由此可见,开源社区有望迎来新一轮创新浪潮。
7月27日晚上十一点,月之暗面发布Kimi K3的模型权重、技术报告,并开源支撑Kimi K3模型训练的关键Infra技术:MoonEP、FlashKDA和AgentEnv。这意味着,每个人都可以下载并部署Kimi K3模型——无论是用于内部研发,还是嵌入到面向终端用户的产品中,均可自由使用。
7月22日,国内大模型独角兽月之暗面计划于8月启动上市前最后一轮融资谈判,目标估值为投前500亿美元。据知情人士透露,公司预计将在未来几天完成Kimi K3发布前启动的一轮融资,该轮融资估值约投前315亿美元。融资完成后,月之暗面将立即启动新一轮融资洽谈,这将成为公司赴港上市前的最后一次私募股权融资。公司最快可能于6个月内登陆香港资本市场。
7月17日至7月20日,月之暗面在2026WAIC期间发布全球最大开源模型Kimi K3,登顶Frontend Code Arena榜首,引发全球关注。由于用户请求量远超预期,月之暗面宣布暂停C端新用户订阅。马斯克发文称Kimi产品“令人印象深刻”。月之暗面总裁张予彤宣布Kimi ARR创历史最大单日增幅,公司计划最快六个月内赴港上市。
7月16日,月之暗面正式发布旗下迄今能力最强大模型Kimi K3。该模型总参数达2.8万亿,是全球首个开源的3万亿级别模型,基于KDA 混合线性注意力机制、注意力残差技术构建,原生支持视觉理解,并拥有100万token上下文窗口。面向长程编程、知识工作和推理等前沿智能场景而设计。
Kimi K3基于Kimi Delta Attention(KDA)和Attention Residuals(AttnRes)构建,进一步扩大了稀疏MoE架构,扩展效率较前代提升2.5倍,官方评测显示其综合性能仅次于Claude Fable 5与GPT-5.6 Sol。目前模型已通过官网、APP、API等全渠道上线,完整模型权重将于2026年7月27日前发布。
MiniMax
7月31日,MiniMax发布新一代多模态生成模型 MiniMax H3,支持文本、图像、视频、声音组成的多模态上下文的统一理解能力、能够输出具备原生双声道的音视频,最高可支持15s 2K分辨率。在指令遵循、文字与品牌信息呈现、V2V Motion Transfer等方面表现出色,适用于广告、电商、游戏等商业场景。该模型采用Contextual Omni Representation、H3-VAE、H3-Omni Transformer等技术,2K分辨率下每秒价格不到主流模型的1/3。MiniMax计划在未来几天内,在符合相关法律法规的前提下,开放模型权重。
7月17日至7月20日,在2026世界人工智能大会上,MiniMax首次公开发布旗舰全模态大模型M3,并预热新一代多模态生成模型H3。
M3采用MoE架构,总参数量428B、单次激活参数量23B,支持1M上下文以及图片、视频输入,具备编程、工具调用和桌面操作能力。依托自研MSA稀疏注意力机制,1M上下文下预填充和解码速度较上一代分别提升9倍和15倍。该模型已获得英伟达、AMD、华为昇腾、摩尔线程等多家算力平台的Day-0适配支持。
应用端同步展出MiniMax Hub多模态创作平台与MiniMax Code编程产品,演示多智能体协同完成内容创作与复杂软件工程任务的完整工作流。
7月16日,MiniMax正式更新Code 2.0桌面端,基于开源框架Pi Agent完成了MiniMax Code的底层架构全面重构,显著提升全场景运行流畅度与长程复杂任务稳定性。
新版重构会话运行、状态管理与工具调用链路,加快首次响应速度,大幅减少异常中断问题,重点改善长任务执行过程中的等待、中断与上下文衔接问题。同时对文件预览、图表等常用功能进行了优化,新增文件预览支持框选编辑。目前,MiniMax已打通恒生金融数据库、企查查 MCP等应用,金融模块已在网页版开放体验,远程控制、浏览器操控等功能也将于本月推出。
7月10日,MiniMax创始人兼CEO闫俊杰发布内部全员信,回应近期市场波动,并强调公司长期方向不变。闫俊杰在信中宣布,从即日起,直到公司实现AGI的那一天,他将不再从公司领取任何薪酬。未来四年,他将拿出个人名下相当于公司总股本4%的股份,用于激励长期与公司并肩作战、共同创造价值的团队成员;同时拿出1%的股份设立专项基金,持续支持相关开源社区的发展。
百度
7月27日,百度正式发布小度AI手表Fit,成为又一款搭载文心大模型的智能穿戴设备,定价198元。核心卖点在于AI语音交互:轻触表盘即可通过语音向文心大模型提问,支持AI生成个性化定制表盘。健康监测方面支持心率、血氧、压力、情绪和睡眠的全天候自动监测。硬件配置上配备1.95英寸屏幕、8.8mm厚度、42g重量,内置100余种运动模式,支持IP68防尘防水,续航可达7天。
7月17日至7月20日,百度在2026WAIC展示“芯云模体”全栈布局:李彦宏提出的DAA指标由IDC发布首份研究报告,预测2030年全球活跃智能体将达22.16亿个;百度搭子获评大会“镇馆之宝”;秒哒3.5正式发布,以33.4%份额居国内无代码AI应用生成平台第一,累计服务3500万用户;昆仑芯第四代AI芯片M100首次公开亮相,天池256超节点推理效率提升50%。百度在2026 WAIC上完成了从度量衡标准、芯片算力、大模型到智能体应用的“芯云模体”全链条AI布局展示。
7月16日,百度集团发布公告,董事会已授权管理层推进在香港联交所主板自愿转换为主要上市,预计于今年内生效。双重主要上市一旦生效,百度将在香港、纳斯达克实现双重主要上市。市场人士分析,百度有望赶上今年9月港股通调整窗口。
7月10日,百度AI DAY搭子专场在成都举行。发布会上,百度搭子个人版升级智能路由、多端共享记忆、浏览器调用、PPT生成等多项能力,并发布行业首个自媒体专业套件;百度搭子企业版正式发布,全面支持企业场景落地。同日,百度智能云正式发起 “百度搭子伙伴招募计划”(搭子联盟) ,中国联通、创维等伙伴参与共建。百度搭子自上线以来日均提问次数增长20倍。
7月9日,百度网盘正式宣布时代少年团成为品牌代言人,并同步发布“和时代一起,全盘掌握”的系列内容。作为拥有全球10亿用户的国民级产品,百度网盘此次携手时代少年团,聚焦高效学习、轻松办公、美好生活等场景。作为“AI网盘”定义者,百度网盘已上线AI笔记、AI修图、AI听记、AI剪辑等功能,其与百度文库联合推出的通用智能体GenFlow月活用户达1亿。用户可通过GenFlow 4.0一句指令调度多个智能体,一站式完成图文影音内容创作。
云知声
7月28日,近日,云知声宣布语音大模型 U2-ASR 与 U2-TTS 完成能力升级。U2-ASR 新增 13 种国际语言识别能力,覆盖欧洲、东南亚、中东、拉美等出海重点市场,工业级测试集平均字错率低至6.58%,5个重点语种字错率进入5%以内。U2-TTS新增8种东南亚语言语音合成能力。升级后U2语音大模型已支持超100种中国方言及超15种国际语言,相关能力已全量上线TokenHub大模型服务平台并开放标准API。
7月17日至7月20日,2026世界人工智能大会期间,云知声携以U2为核心的U-Model模型矩阵与数字专家Agent、数字员工Agent、数字助理三大智能体集群参展,系统展示AI从「会回答」走向「能执行」的落地成果,覆盖医疗健康、组织流程、日常办公等场景。创始人兼CEO黄伟出席「从大模型到智能体」论坛并发表《从理解到行动:智能体如何走进真实世界》主题演讲;联合创始人兼CTO梁家恩出席「未来计算・未来算力」论坛,分享Token经济与算力价值化的产业实践。
7月17日,云知声基于U2基座模型完成医疗大模型迭代,正式发布U2-Med三医大模型,是行业首个同时覆盖医疗、医保(含商保)、医药三大领域的专业大模型。在2026年7月MedBench评测中,该模型在全模态大模型和智能体两项榜单均位列第一;三医综合Benchmark中非思考模式得分89.1、思考模式得分88.9,其中病历生成与质控93.3分、诊后与用药管理94.1分。同日公司公告签约多个三甲医院大模型项目,加速医疗场景商业化落地。
7月16日,国内权威中文医疗大模型评测平台 MedBench 5.0 发布全新迭代评测结果,云知声自主研发的三医大模型 U2-Med 凭借卓越的逻辑推理能力,在“智能体评测榜单”核心文本榜单中强势登顶。同时,基于 U2-Med 文本底座结合视觉编码器联合训练而成的 U2-RadiMed(医疗影像大模型),在“全模态大模型评测榜单”中斩获第一。
7月8日,在 2026 中国互联网大会-智能体互联网论坛上,云知声凭借在智能体领域的技术积累与场景落地能力,取得三项重要成果:“兽牙Claw”通过首批企业级类Claw智能体安全能力评估,“智能文件技术审查应用”通过互联网智能体可信评估登记,云知声入选首批“智能体开源社区”成员单位。三项成果集中亮相,体现了云知声在智能体技术底座、场景应用和生态共建方面的持续积累。
科大讯飞
7月17日至7月20日,2026世界人工智能大会期间,科大讯飞以“解放生产力、释放想象力”为主题参展,集中展示自主可控大模型底座、行业解决方案及多款AI终端产品。展会现场正式发布面向公共服务场景的GuideX智能交互Agent,融合全模态感知、自治智能体、行业技能库能力,覆盖政务、展馆、交通等服务场景,实现低延迟多模态人机交互。其中讯飞双目多模态AI眼镜从三千余项展品中脱颖而出,入选WAIC 2026十大“镇馆之宝”。这款产品整机重量约40克,搭载唇动识别降噪方案,支持122种语言翻译,内置AI助理,可依托视觉信息完成资料检索、文稿生成等工作。展台同期展出星火AIPC、AI学习机、同窗AI黑板等全系AI硬件。
同期科大讯飞与普元信息签署大模型人机协同生态赋能协议,携手打造人机协同新模式。
7月14日,科大讯飞披露了2026年半年度业绩预告。今年上半年,公司预计归母净利润为-2.28亿元至-1.8亿元,同比有所减亏;销售回款总额约118亿元,较去年同期增长约15亿元。上半年公司合同额同比提升27%。
关于业绩变动原因,科大讯飞称,一方面,公司根据做强C端、做深B端、优选G端的原则,主动推进业务战略聚焦。今年上半年,G端业务收入同比下降2.13%,业务结构持续优化。另一方面,上半年,公司持续加大研发投入,占营业收入比重逾20%。
7月2日,2026科大讯飞智能交互生态发布会在深圳举行,公司AIUI平台、多语种交互平台、机器人超脑平台同步升级。其中,AIUI平台从语音交互向多模态AI交互平台演进,融合图像理解与生成能力;多语种交互平台覆盖40余种语言,一站式赋能智能硬件出海;机器人超脑平台强化多模态感知、复杂任务理解与场景执行能力,加速机器人从实验室走向真实产业。
华为
7月31日,华为正式宣布开源盘古5050亿参数的openPangu-2.0-Pro模型(模型权重、基础推理代码)及技术报告正式开源上线。开源盘古openPangu是华为开源AI模型品牌,致力于通过昇腾原生训练与推理技术,为业界用好昇腾提供最佳实践参考,助力打造Agent时代强大的智能底座。
7月28日,近日,由华为2012实验室、华为云、终端小艺等团队联合构建的开源AI Agent平台openjiuwen,联合华为终端平板与PC产品线、软件部等团队,推出 JiuwenSwarm蜂群智能体的鸿蒙PC版本,这也是首个面向鸿蒙PC的开源AI统一工作台。该工作台依托Coordination Engineering(协同工程)技术体系,创新推出HITS(Human in the Swarm)人机协同范式,实现人与智能体共同组队,一站式覆盖企业办公、代码开发、休闲娱乐等核心场景,全套代码开源开放。
7月28日,华为开启鸿蒙HarmonyOS 7花粉Beta版推送,核心升级为小艺基于Agentic全面进化——支持自主学习、意图拆解与长线任务执行;系统新增全局沉浸光感、星盾防诈支持AI变声监测并开放给第三方生态,同时带来超百项体验优化。
7月22日,在日前举办的 2026 年国际数学奥林匹克竞赛(IMO 2026)中,华为小艺以满分 42 分摘得 IMO 2026 金牌。今年小艺首次获得42分满分金牌,充分展现了小艺在多数学分支上齐备且稳定的综合求解能力,也标志着在高级数学推理与复杂问题求解上取得重要进展。小艺展现了一种全新的解题范式。与人类数学家擅长凝练主线、捕捉关键灵感的优势不同,小艺的Agentic系统则像一支协同工作的数学研究团队:多个Agent同时提出猜想、探索不同路线、寻找反例、验证引理,并根据进展动态调整资源。这标志着AI正从“辅助回答”向“自主完成复杂任务”迈进。
7月17日至7月20日,华为在2026WAIC集中展示昇腾AI全栈布局:昇腾950超节点真机首次公开亮相,实现业界最大1024卡规模,斩获大会SAIL最高奖;同期展出Atlas 850E风冷超节点,无需液冷改造即可上架部署;华为首次披露昇腾384超节点已累计规模商用750多套,CANN开源社区代码超1244万行。大会期间,华为举办电力行业峰会,联合南网、华能澜沧江、华电湖北发布三项电力AI创新成果;华为中国政企互联网行业总经理黄健指出“运力是AI算力最大瓶颈”,华为已将NPO带宽提升八倍以上。
智谱 AI
7月31日,智谱宣布,随着基础设施持续扩容,面向开发者群体的付费订阅服务GLM Coding Plan开放订阅。此前因AI Coding需求爆发,用户需求增长,阶段性限制订阅名额。另据了解,智谱已落地1GW级国产AI算力数据中心建设,全部采用国产AI芯片,并持续投入算力基础设施建设。
7月21日,智谱全资收购中科加禾(XCore Sigma):交易金额数亿元人民币。该公司源自中科院计算所编译实验室,专注异构算力软件栈、编译优化与AI推理引擎,收购后将补齐智谱在算力释放层的核心能力,提升国产芯片利用率、降低推理成本。同日,智谱落地1GW级全国产AI算力数据中心:全部采用国产AI芯片构建,为大规模模型训练提供稳定自主的算力供给。
7月17日至7月20日,智谱亮相2026世界人工智能大会,核心展示GLM-5.2的百万级超长上下文能力:可在单次任务中处理88万以上token,支持AI连续数小时自主完成完整大型工程。智谱方面同时表态,真正的安全源于开放而非封闭,将继续践行开源可信路线,把技术突破铺成全行业可及的台阶。
7月13日,智谱公告配售事项完成,全部1978万股新H股已按每股1588港元成功配发,扣除佣金及开支后募资净额约313.75亿港元。此次配售是智谱1月港股上市后首次再融资,也是港股AI板块年内最大规模再融资之一。
7月11日,智谱创始人唐杰发布题为《巨浪已来》的内部信,正式启动"Touch High(摸高)" 战略计划。核心决策为:未来两年战略性投入,不追求短期应用变现,直指 AGI 下一高地。四大技术引擎布局:1.长程任务,研发新一代记忆架构,支持 AI 贯穿项目全生命周期自主工作;2.自治智能体,构建智能体社会协同体系,从单一助手走向多智能体协作;3.自我训练,探索 AI 自我改进、数据工厂与沙盒内代码重构能力;4.安全治理,构建可解释、可控的 AI 安全体系。
中科曙光
7月23日,光合组织 2026 智能计算应用大会期间,中科曙光正式发布Gridview 7.0超智融合平台。该平台采用双引擎调度架构,基于自研MetaStack调度引擎与Kubernetes融合,实现超算与智算资源的统一管理与协同调度,支持传统科学计算任务与AI任务在同一算力池中灵活调配,提升大规模集群资源利用效率,推动算力从“建设”向“高效使用和规模化运营”转变。
7月17日至7月20日,2026世界人工智能大会期间,曙光8000(登峰)真机首次面向全球公开亮相,并从3000余项展品中入选WAIC 2026十大"镇馆之宝"。目前,曙光8000已依托国家超算互联网接入全国一体化算力网,完成300余项重点应用优化,覆盖20余个科研和产业领域,超过70项应用实现万卡规模扩展。
展台同时展示全栈智算解决方案,包括ParaStor分布式存储、浸没式液冷技术及AI for Science应用成果,系统呈现从底层算力到上层应用的完整能力矩阵。
7月10日,光合组织2026智能计算应用大会期间,中科曙光宣布中国首个全国产十万卡AI超集群——曙光8000(登峰)正式落成,并同步接入国家超算互联网。该集群采用超智融合技术路线,实现科学计算与智能计算原生融合,支持 FP64至INT8全精度计算,贯通芯片、计算、存储、网络、散热全链路。集群搭载海光国产芯片,采用自研scaleFabric高速互连技术与浸没式相变液冷方案,单计算单元算力密度较传统超节点提升20倍。目前已完成300余项应用优化,覆盖大模型、创新药、新材料等20余个领域。
同日,中科曙光与豫信电科签署战略合作协议,推动十万卡AI超集群在河南落地,优先探索医疗场景应用。
360
7月28日,360集团创始人周鸿祎正式发布新一代企业智能体工作平台"纳米Work",面向企业老板、创业者、一人公司及企业员工。周鸿祎提出"企业搞AI,老板要先用"的观点,并宣布为首批用户每人提供1亿Token试用额度。纳米Work构建了多智能体引擎、多模型底座、云端办公室、多工作模式和多专家五大能力体系,将"原生安全、出厂内置"作为设计原则。360同步启动纳米Work城市合伙人招募。
7月20日,360“图龙锋”AI 漏洞挖掘智能体如期正式开放试用。产品搭载多智能体协同架构,由项目画像、任务编排、攻击面分析、静态审计、动态验证、报告生成等专业Agent分工协作,模拟完整安全团队工作流。据悉,“图龙锋”凭借智能体工程化路线,已具备与Mythos同等能力,目前累计挖掘安全漏洞超过4000个。
7月17日至7月20日,2026 世界人工智能大会期间,360创始人周鸿祎参会并阐述“安全 + AI”双轮驱动战略。他提出不发展才是最大的不安全,360将依托安全能力护航AI产业规模化落地,布局安全大模型、智能体蜂群技术,推进AI在安全、政企服务等场景落地,发力超级个人、超级组织、超级AI安全三大方向。
在大会配套的“智聚长三角・AI 安全赋能产业创新论坛”上,360联合大模型产业联盟发起“磐石之盾・长三角AI安全共同体”。共同体首批14家成员单位,覆盖政务、金融、医疗、制造、能源等关键领域,成员将围绕AI风险排查、漏洞挖掘、威胁预警、应急处置开展常态化协作;360同步向首批成员单位开放“图龙锋”AI漏洞挖掘智能体能力。
7月9日,针对智能体合规监管趋严的行业背景,360发布首份《企业智能体安全运营指南》白皮书。白皮书系统梳理智能体进入企业后“看不见、控不住、管不好、追不回”四类核心风险,提出“看见风险—管住行为—协同提效”的安全运营方法论,并给出智能体身份认证、权限分级、行为审计等可落地的实操框架。
快手
7月17日至7月20日,2026世界人工智能大会期间,可灵AI发布灵动画布多人协同创作工作台,支持最多5人实时协同、无限画布、智能创作辅助;同步升级Kling 3.0开放平台API,优化接口架构、下调调用定价,新增首尾帧控制、智能运镜指令功能。展台展示可灵视频生成、可图图像模型全栈AIGC能力。
7月2日,快手旗下可灵AI完成独立首轮融资,融资上限204.47亿元(约30亿美元),投后估值约180亿美元,较4月200亿美元目标有所下调,但仍为全球视频大模型最大单笔融资。投资方包括腾讯、阿里、百度及多家PE、科创基金和中东资本。快手仍间接持股68.33%保持控股权。财务数据显示,2025年营收11亿元,2026年3月年化收入运行率达5亿美元,但2024—2025年累计净亏24亿元,净资产为负900万元。
昆仑万维
7月19日,昆仑万维在WAIC专场论坛上宣布2026年为“世界模型元年”,董事长方汉指出AI核心从“内容生成”转向“物理世界理解与交互”。同日,公司连发三款模型:Matrix-Game 3.5世界模型(5B参数,720p/20FPS实时生成,1分钟记忆);Mureka v9.5与O3音乐模型(定位中国最强、全球前二,情感得分7.88);Riemann-1.0世界动作模型(面向具身智能,基于23.2万小时数据训练)。7月23日,“天工超级智能体”入选WAIC《智能体创新实践汇编》,获行业权威认可。
7月16日,昆仑万维对天工短剧工作台进行了新一轮核心架构升级,正式推出 “Agent(智能体)智能分镜+无限画布”双轨创作体系。其中,“Agent智能分镜”利用大模型的逻辑推理能力,自动将剧本拆解为详细的分镜脚本、角色调度及镜头语言;“无限画布”则为创作者提供了非线性、可无限扩展的视觉编排空间。此次迭代直击AI短剧行业长期存在的“生成结果随机性强、镜头连贯性差、成片质量不稳定”等规模化生产痛点,旨在将AI短剧从“手工小作坊”模式推进至“标准化工业流水线”模式,大幅降低批量产出门槛。
7月2日,昆仑万维旗下天工AI发布Skywork 3.2版本,正式推出Skywork Tags功能,支持个人和团队在Slack、飞书、钉钉、Discord、Telegram等平台直接拉入群聊,以团队成员身份参与协作,@即可调用,无需切换平台或迁移上下文,支持任务进度透明、多人接力和长期上下文沉淀,目前已正式上线。
同日,昆仑万维宣布天工AI在2026年Q2实现历史性突破,AI Native模型与产品业务年度经常性收入(ARR)超过8亿美元,其中AI短剧平台业务ARR超7亿美元,AI工具业务ARR突破1亿美元。短剧平台DramaWave完成AI原生化转型,超80%新增内容由AI生成。视频生成模型SkyReels、音乐生成模型Mureka、游戏世界模型MatrixGame均登顶国际权威榜单,核心业务连续多个季度保持双位数环比增长。
阶跃星辰
7月17日,WAIC 2026正式开幕。阶跃星辰携全球首个智能体原生操作系统Step AOS亮相,STEPX Neo也首次以实物姿态公开亮相。现场展台设置了三台STEPX Neo,分别代表三位偏好、生活状态各不相同的“用户”,直观展示智能体基于记忆形成的个性化差异。
同日,阶跃星辰董事长印奇在WAIC开幕式主论坛上发言,将智能体带来的下一阶段变化概括为 “新系统、新载体、新网络” 。他表示,随着智能体模型与下一代终端产品加速结合,智能正从数字屏幕走向真实物理世界,智能体将从聊天工具进化为能够感知、决策和执行任务的生产力最小单元。
7月14日,作为阶跃星辰的战略合作伙伴,千里科技宣布将Step AOS、阶跃Amoo、Step Edge全面引入汽车领域,率先打造面向智能体时代的大模型原生汽车终端体验。阶跃Amoo进入车端后将成为懂用户、能思考、会行动的智能出行伙伴。
7月13日,阶跃星辰正式发布全球首个智能体原生操作系统Step AOS(Step Agentic-native OS)、基于模型矩阵及Step AOS打造的个人智能体阶跃Amoo,以及大模型原生AI终端品牌STEPX。全球首款大模型原生智能体手机STEPX Neo同场亮相。Step AOS为智能体从零构建运行环境,在记忆、决策与安全三方面实现突破:日常问答记忆召回最快仅需15毫秒,达SOTA水平,设闹钟、找照片等端侧任务执行成功率超99%,并首次提出“可信、可见、可控、可逆”四维安全体系。交互范式从“过程交互”转向“结果交互”,用户只需表达意图,智能体直达结果。阶跃还联合上海AI实验室发布《新一代智能体系统安全技术白皮书》及《端侧大模型网络安全指南》,共同研制智能体安全技术国家标准。
7月12日,阶跃星辰推出Step Edge端侧模型全家桶,共4款模型,覆盖文本视觉、音频理解、语音识别、GUI、图像生成与编辑等多个方向。该模型专为手机、汽车等终端硬件定制,具备超低本地延迟响应、全模态本地隐私保护、原生端云协同等核心能力。Step Edge在29项核心评测指标中位列同类端侧模型第一。
爱诗科技
7月17日,2026世界人工智能大会(WAIC)在上海开幕。爱诗科技携PixVerse Game亮相西岸会场,搭建了一个可供观众亲身体验的展位。玩家可以通过自然语言实时生成画面、音效与叙事,实现“创造即游玩”的全新体验。
7月14日,爱诗科技今日宣布完成整体C轮融资,本轮累计融资29.8亿元人民币。其中C +轮由阿里巴巴领投,Lollapalooza Capital、钟鼎资本、蓝色光标等十余家国内外产业与财务机构参投。
本轮融资将主要用于视频生成基础模型、实时世界模型,以及全球化产品增长与产业场景落地。爱诗科技年初推出全球首个支持 1080P 分辨率的通用实时世界模型PixVerse R1,截至目前,PixVerse全球用户已超1.5 亿。爱诗科技联合创始人谢旭璋日前在联合国AI for Good峰会上,还展示了基于世界模型技术构建的首个实时视频游戏引擎PixVerse Game。其产业侧已与芒果传媒等内容与产业伙伴达成战略合作关系,覆盖内容生产、互动影游等落地场景。
DeepSeek
7月14日,据彭博社等多家媒体援引知情人士消息,DeepSeek已正式启动IPO筹备工作,目标登陆境内资本市场,最快于2026年内提交上市申请,计划2027年完成挂牌,当前正推进财务梳理等前置工作。
同步开启的第二轮私募融资投前估值约710亿美元(约合人民币4800亿元),较6月完成的首轮融资投后520亿美元估值上涨约37%。
7月31日,DeepSeek在API文档更新日志中宣布,DeepSeek-V4-Flash正式版API开启公测,模型版本更新为DeepSeek-V4-Flash-0731。开发者可使用原有的“deepseek-v4-flash”名称调用,无需更换接口。
根据DeepSeek介绍,此次更新的V4-Flash-0731模型架构和参数规模与V4-Flash预览版保持一致,仅重新进行了后训练,主要改善代码修改、工具调用和多步骤任务执行等Agent能力。
数据支持天眼查,大模型独家合作账号









