商汤科技正式发布并开源了与南洋理工大学 S-Lab合作研发的全新多模态模型架构 ——NEO,为日日新SenseNova多模态模型奠定了新一代架构的基石。
作为行业首个可用的、实现深层次融合的原生多模态架构(Native VLM),NEO 从底层原理出发,打破了传统“模块化”范式的桎梏,以“专为多模态而生”的创新设计,通过核心架构层面的多模态深层融合,实现了性能、效率和通用性的整体突破,重新定义了多模态模型的效能边界,标志着人工智能多模态技术正式迈入“原生架构”的新时代。
论文网址:https://arxiv.org/abs/2510.14979
打破瓶颈:告别“拼凑”,拥抱“原生”
当前,业内主流的多模态模型大多遵循“视觉编码器+投影器+语言模型”的模块化范式。这种基于大语言模型(LLM)的扩展方式,虽然实现了图像输入的兼容,但本质上仍以语言为中心,图像与语言的融合仅停留在数据层面。这种“拼凑”式的设计不仅学习效率低下,更限制了模型在复杂多模态场景下(比如涉及图像细节捕捉或复杂空间结构理解)的处理能力。
商汤 NEO 架构正是为了解决这一痛点而生。早在2024 年下半年,商汤便在国内率先突破多模态原生融合训练技术,以单一模型在SuperCLUE语言评测 和OpenCompass多模态评测中夺冠,并基于这一核心技术打造了日日新SenseNova6.0,实现多模态推理能力领先。之后,在2025 年 7 月发布日日新SenseNova6.5 通过实现编码器层面的早期融合,把多模态模型性价比提升 3 倍,并在国内率先推出商用级别的图文交错推理。商汤此次更进一步,彻底摒弃了传统的模块化结构,从底层原理出发,推出了从零设计的 NEO 原生架构。
三大内核创新:实现视觉和语言的深层统一
NEO 架构以极致效率和深度融合为核心理念,通过在注意力机制、位置编码和语义映射三个关键维度的底层创新,让模型天生具备了统一处理视觉与语言的能力:
●原生图块嵌入(Native PatchEmbedding):摒弃了离散的图像tokenizer,通过独创的Patch Embedding Layer (PEL)自底向上构建从像素到词元的连续映射。这种设计能更精细地捕捉图像细节,从根本上突破了主流模型的图像建模瓶颈。
●原生三维旋转位置编码 (Native-RoPE):创新性地解耦了三维时空频率分配,视觉维度采用高频、文本维度采用低频,完美适配两种模态的自然结构。这使得 NEO 不仅能精准捕获图像的空间结构,更具备向视频处理、跨帧建模等复杂场景无缝扩展的潜力。
●原生多头注意力(Native Multi-Head Attention):针对不同模态特点,NEO在统一框架下实现了文本token的自回归注意力和视觉token的双向注意力并存。这种设计极大地提升了模型对空间结构关联的利用率,从而更好地支撑复杂的图文混合理解与推理。
此外,配合创新的 Pre-Buffer & Post-LLM 双阶段融合训练策略,NEO 能够在吸收原始 LLM 完整语言推理能力的同时,从零构建强大的视觉感知能力,彻底解决了传统跨模态训练中语言能力受损的难题。
实测表现:十分之一的数据,追平旗舰级性能
在架构创新的驱动下,NEO 展现出了惊人的数据效率与性能优势:
极高数据效率:仅需业界同等性能模型 1/10 的数据量(3.9亿图像文本示例),NEO 便能开发出顶尖的视觉感知能力。无需依赖海量数据及额外视觉编码器,其简洁的架构便能在多项视觉理解任务中追平 Qwen2-VL、InternVL3 等顶级模块化旗舰模型。
性能卓越且均衡:在 MMMU、MMB、MMStar、SEED-I、POPE 等多项公开权威评测中,NEO 架构均斩获高分,展现出优于其他原生 VLM 的综合性能,真正实现了原生架构的“精度无损”。
极致推理性价比:特别是在 0.6B-8B 的参数区间内,NEO 在边缘部署方面优势显著。它不仅实现了精度与效率的双重跃迁,更大幅降低了推理成本,将多模态视觉感知的“性价比”推向了极致。
开源共建:构建下一代 AI 基础设施
架构是模型的“骨架”,只有骨架扎实,才能支撑起多模态技术的未来。NEO 架构的早期融合设计支持任意分辨率与长图像输入,能够无缝扩展至视频、具身智能等前沿领域,实现了从底层到顶层、端到端的真正融合。从应用角度,端到端的“原生一体化”设计,为机器人具身交互、智能终端多模态响应、视频理解、3D交互及具身智能等多元化场景的应用,提供了坚实的技术支撑。
目前,商汤已正式开源基于 NEO 架构的2B 与 9B两种规格模型,以推动开源社区在原生多模态架构上的创新与应用。商汤科技表示,致力于通过开源协作与场景落地双轮驱动,将 NEO 打造为可扩展、可复用的下一代 AI 基础设施,推动原生多模态技术从实验室走向广泛的产业化应用,加速构建下一代产业级原生多模态技术标准。
Github开源网址:https://github.com/EvolvingLMMs-Lab/NEO
《H漫工囗同人志》,《首次登录送91元红包》午夜视频嗷嗷叫
“91美女视频永久下载app”
91麻豆果冻传媒在线影院
……
{!! riqi() !!}
“aa在线观看视频国产片”{!! reci() !!}
↓↓↓
{!! riqi() !!},2025年京津冀晋大学生诚信辩论大赛收官,黑人一级黄片视频,大BBW大BBWBBw,国产长筒靴❌AV在🔞线播放㊙️,免费va国产欧美一区高清
{!! riqi() !!},“中国通”大山对话千年东坡 纪录片《不系之舟》常州首映,成年人毛片,小米粒爱情海直播app,国产沙发午睡系列99,se01亚洲视频
{!! riqi() !!},贝宁部分军人政变 总统府称军队正在恢复控制权,农村同❌性壮🔞汉肉H文㊙️,人工智能qvod,和学舞蹈的女朋友叭叭叭,色多多aPP污丝瓜下载地址
{!! riqi() !!}|【光明论坛】推动新产业、新模式、新动能发展|AA黃色网站|中文字幕第6页|体育生运动裤|蜜桃传媒视频麻豆第一区免费观看
{!! riqi() !!}|两部门:积极推动商保创新药目录纳入商业健康保险保障范围|原神被❌绑🔞在坐脸上放㊙️屁|丝瓜视频无限观看污app苹果|日❌本片🔞XXXXXXXXXX68|斗罗玉转漫画1—37免费漫画
{!! riqi() !!}|东北铁路首次推出15日旅游计次票 一次购票玩转黑吉辽冰雪胜地|久久九九久久这里是乌克兰:美女精品|国产奸污视频|欧美色最新精品视频在线播放|国产永久免费视频……
{!! riqi() !!},史上最低价童颜针,靠谱吗?,铜铜铜铜铜铜铜好疼免费动漫在线观看,亚洲综合青春偷拍视频,2021三?片,亚洲国产精品综合每日更新
{!! riqi() !!},日本市场遭遇股债“双杀”,男人看影院看哪个app,国产一级A片,性爱视频在线三级片,免费观看的av网址大全
{!! riqi() !!}|青海构建融合发展体系 推动阅读从书页“走向”生活|海角社区综合三区|热血江湖网名|丁香琪琪国产精品影院|国产精品一级黄色录像老女人偷情国语
{!! riqi() !!},史上最低价童颜针,靠谱吗?,5h6h8h❌是什么🔞意思㊙️,欧美激情精品久久久久久,欧美日韩亚洲综合色图,老奶奶能叫WOMAN吗
{!! riqi() !!},3.6万人竞逐2025南宁马拉松 非洲选手破纪录夺冠,黄色视频欧美,香蕉tv网络电视,精❌品🔞无码一区二区三㊙️区免费看,农场人与兽三级黄色
{!! riqi() !!},重庆江南隧道主线建成通车,女教师大荫蒂毛茸茸视频,双乳❌峰摸晃揉🔞捏奶头抖动㊙️,Да❌ва🔞й熟女,国产成人一区二区三区️影院
{!! riqi() !!}|驻港国家安全公署:坚定支持香港特区依法严惩反中乱港分子“以灾乱港”行径|三级中文字幕永久在线视频|香蕉app下载二维码污|两个人在线观看视频播放|老师没带罩子被吃了一节课
{!! riqi() !!}|巴西利美拉举办“中国文化日”|叫上甘️雨|❌❌❌❌中国XXXXx|yse360影视|白若冰别名杜鹃
{!! riqi() !!}|上海业主私挖地下室事件最新进展如何?治理违建难到底在哪儿?|Ch❌i🔞nαeseGrαnny性|❌小奶娃榨🔞精记h㊙️文|欧美性爱2024|亚洲成AV人片不卡无苍井空
{!! reci() !!},{!! reci() !!}|解锁银川幸福密码:让民生温暖直达人心|无码专区欧美激情视频在线|一个人免费视频在线观看高清完整|富二代成人版抖音app|www.91.桃射
监制:邓金木
策划:赖晗
主创:唐征宇 林箴贺 陈佛烘 颜亦阳 陈林韵
编辑:王家菁、段圣祺