六款大模型上线国家超算互联网AI社区(图1)

  近日,国家超算互联网(SCNet)AI社区迎来一波密集模型上线潮,涵盖多模态理解、智能体推理、科学计算、语音识别等多个技术方向。仅最近一个月,就有六款大模型上线。

  据了解,这些国产模型在核心能力指标上已比肩甚至超越部分国际顶尖闭源模型。

  紫东太初新一代面向物理世界的通用多模态大模型ZDTaichu5.0-9B,以Qwen3.5-9B为语言骨干、C-RADIOv4-H为视觉骨干构建,参数量约9B,支持文本、单图、多图与视频输入,最高128K token上下文,并兼容任意分辨率视觉输入。在九大国际权威空间理解基准的横向评测中,ZDTaichu5.0-9B在10B参数量级内斩获8项组别第一,成为该级别空间具身能力最强的通用多模态大模型。

  上海人工智能实验室此次有两款模型同时登陆SCNet平台。其中,Atria Dawn Preview定位为面向科学研究、工程开发与专业工作流的智能体基础模型,基于7440亿参数MoE GLM-5.2基座构建,支持256K上下文。其核心亮点在于“可验证经验流水线”设计,在覆盖真实研究、工程和数字工作的16项基准测试中,Atria Dawn Preview在5项中取得最高分,另有3项位列第二。

  同期上线)则聚焦长程科研能力与智能体能力。在知识、代码、智能体等通用能力上跻身开源模型第一梯队的同时,书生-S2在Biology-Instructions、Mol-Instructions等生命科学与材料结构理解、生成与设计任务上表现优异。在IMO-Proof、AdvancedMathBench等强调长程严谨推理的竞赛数学与高等数学基准上,书生-S2整体领先现有开源模型,达到Gemini 3.1 Pro等闭源模型水平。

  网易有道开源的Confucius4-R2T2基于Qwen3-ASR-1.7B构建,定位为低延迟、高精度的真正流式自动语音识别(ASR)模型。该模型支持从80毫秒到2秒的细粒度、可配置解码块,在仅200至600毫秒平均延迟下即可实现接近离线识别的准确率。实测显示,R2T2在延迟和识别质量方面达到开源模型SOTA水平。

  由上海创智学院发起的Nex-AGI发布并开源新一代智能体模型系列Nex-N2.5,包含Mini、Pro、Max三个版本,面向真实环境长程任务。三款模型共享“智能体后训练”主线:Mini与Pro重点强化计算机使用、网页浏览与视觉辅助的能动性;Max建立在DeepSeek-V4-Pro-Base之上,采用1.6T总参、每Token激活49B的纯文本MoE架构。在多项权威基准中,Nex-N2.5与Claude Opus 5、GPT-5.6 Sol等顶尖闭源模型互有高低。

  中国电信旗下中电信人工智能科技有限公司开源的星辰语义大模型系列新一代模型Xing4.0-29B-A4B,总参数量29B,激活参数仅4B,原生支持256K上下文并可扩展至512K。该模型采用mHC+MLA+MTP架构设计,面向Agent场景优化多步骤规划、工具调用与复杂推理链路执行,保障长上下文下任务连贯与执行稳定。

  以上国产模型均已在超算互联网AI社区上线,企业、科研机构及开发者可前往平台下载模型权重,开展二次开发、本地部署与技术研究。

  版权声明:凡本网注明“来源:中国科学报、科学网、科学新闻杂志”的所有作品,网站转载,请在正文上方注明来源和作者,且不得对内容作实质性改动;微信公众号、头条号等新媒体平台,转载请联系授权。邮箱:。

  文献清单:2026年精选文章邀您共读 – 系列I Therapeutics

  Telecom:6G时代的无人机通信:从近场理论到智能网络 MDPI 特刊征稿

  Technologies期刊2025年影响因子升至5.2,稳居JCR工程综合学科Q1区

  文献清单:跨越分子手性与生物不对称性的多维探索 MDPI Symmetry

  聚焦人体工程学期刊Theoretical and Applied Ergonomics MDPI 新刊速递

  电场后处理调控MoS多晶型转变与位错调控以增强电磁波吸收