0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

CVPR2025:中科视语发布首个具身物理空间大模型PhysVLM!战略布局“AI+机器人”新生态

爱云资讯 ? 2025-03-19 15:05 ? 次阅读
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

人工智能技术加速向具身智能(Embodied AI)演进的关键节点,中科视语重磅发布其最新前沿成果——PhysVLM(首个机器人物理空间具身大模型),作为具身智能领域的里程碑式突破,PhysVLM 率先实现 “环境感知-本体理解-决策执行” 全链条技术闭环,通过多模态感知、动态环境建模、自主决策规划的深度融合,赋予机器人在复杂物理空间的类人级操作能力。

作为首创“环境感知、本体理解、决策执行”全链条技术突破的AI企业,中科视语以PhysVLM的发布为起点,正逐步构筑面向工业4.0、智慧交通、具身机器人等领域的核心技术底座,重新定义“AI+机器人”协同发展新范式。

物理感知革命,机器人也懂“分寸感”!

随着视觉语言模型(VLM)的快速发展,机器人已能精准理解场景语义,但 “看懂” 不等于 “能做”。传统模型普遍缺乏对机器人自身物理约束的感知能力,导致其在工业、智慧城市等复杂场景中频繁出现“越界操作”,如机械臂试图抓取超出其可达范围的物体,或因未考虑关节限位而引发机械故障。这种 “感知与决策割裂” 的问题,已成为制约具身智能规模化落地的关键瓶颈。

针对这一挑战,中科视语创新性地提出首个机器人物理空间具身大模型,通过创新的空间-物理约束表征的学习范式,有效整合了对环境的视觉理解和对具身智能体的物理空间约束感知,通过三大维度的突破,实现了从 “环境感知” 到 “可靠行动” 的质的飞跃。

构建“空间感知-物理约束”双轮驱动决策体系

具身空间-物理约束建模,打破平台壁垒

首创空间- 物理约束映射(S-P Map)技术,将机械臂的几何参数、关节运动范围等物理约束转化为可学习的视觉语义表征。通过这种 “物理约束视觉化” 的方法,模型无需依赖具体机器人参数即可实现跨平台泛化,为构建通用型具身智能奠定了基础。

视觉-物理空间协同推理,重塑决策逻辑

采用视觉- 物理双编码器架构:主视觉分支保留开放域场景理解能力,物理约束分支专注于可达性分析。通过多模态融合模块和对齐模块,模型能够实时权衡环境语义与物理可行性,生成 “既看得懂又做得到” 的动作规划。例如,当识别到目标物体超出当前机械臂范围时,系统会自动规划 “移动底盘靠近目标” 的分步策略。

wKgZPGfabKiAL72uAAJXiSkTkYg194.png

百万级数据集,定义行业标准

中科视语研究团队构建了包含6类工业机械臂、10万组操作场景的基准数据集,涵盖RGB图像—可达物理空间图(S-P Map)—具身物理问答三元组数据。配套开发的EQA-phys评估基准包含带有4类工业机械臂的仿真环境和问答数据,为具身智能的物理认知提供了量化评估基准。

实验结果表明,PhysVLM在EQA-phys上的性能比GPT-4o高出14%,在RoboVQA-val和OpenEQA等基准测试中也超过了RoboMamba和SpatialVLM等先进的具身VLM。此外,S-P Map与各种VLM高度兼容,集成到GPT-4o-mini后,提升了7.1%的可达性理解任务性能。

战略布局:“三维框架”引领从感知到具身智能跨越

中科视语始终以前瞻性眼光,致力于将先进的通用视觉技术与机器人实际操作深度融合,此次发布的PhysVLM作为重要战略成果,以“三维战略框架”构筑坚实的产业壁垒:

视语坤川?通用视觉大模型:中科视语经过多次技术升级与迭代,构建了多模态大语言模型(MLLM),融合大语言模型的基础能力,结合了视语多年面向行业的人工智能视觉解决方案经验,具备超强的视觉感知能力,并进一步支持了原生的视觉理解与推理。

具身智能核心算法中科视语宣布正式开源PhysVLM(首个机器人物理空间具身大模型),实现 “环境感知-本体理解-决策执行” 全链条技术闭环,为工业、智慧交通等场景提供安全可靠的决策支撑,为具身智能领域开辟了新路径。

行业场景深度融合:中科视语具备20余年行业专业知识储备及成熟的行业落地经验,聚焦工业、交通、具身机器人等高价值场景,推动技术落地。

行业融合加速推进,打造“AI+机器人”协同生态圈

目前,PhysVLM已在多个高价值领域形成实际应用并取得显著成果,尤其在工业4.0、智慧交通、具身机器人等领域展现出突出商业价值。

在工业领域,中科视语智能焊接机器人,在工业焊接、喷涂等精密作业场景中,突破传统机械臂常因路径规划粗放导致碰撞风险高、生产效率低。中科视语创新推出(S-P Map)模型,通过三维空间动态建模与智能视觉路径规划双重引擎,实现机械臂作业效率与安全性的革命性提升。

在交通领域,中科视语智能劝导机器人,在城市交通治理智能化升级的浪潮中,以“AI + 混合模态感知” 技术重构非机动车监管模式。该产品通过实时识别违规行为、动态路径规划及智能语音劝导,实现交通监管效率提升 40%、事故率下降 35%,为智慧城市交通治理提供 “零接触、全时段、高精度” 的创新解决方案。基于此次发布的最新成果,PhysVLM已初步实现跨机器人、跨行业、跨场景的泛化应用能力,逐渐形成产业级的技术壁垒,为工业4.0、智慧城市与服务机器人市场带来新的产业机遇。

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • 机器人
    +关注

    关注

    213

    文章

    29961

    浏览量

    214552
  • AI
    AI
    +关注

    关注

    88

    文章

    35869

    浏览量

    282832
  • 大模型
    +关注

    关注

    2

    文章

    3244

    浏览量

    4237
收藏 人收藏
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

    评论

    相关推荐
    热点推荐

    机器人十大发展趋势

    2025世界机器人大会开幕式上发布了《2025智能机器
    的头像 发表于 08-12 13:22 ?733次阅读
    <b class='flag-5'>具</b><b class='flag-5'>身</b><b class='flag-5'>机器人</b>十大发展趋势

    大象机器人亮相2025年苏州市智能机器人产业生态大会

    近日,苏州市智能机器人产业生态大会在狮山国际会议中心盛大开幕,汇聚全球顶尖专家、行业领袖与创新企业,共绘智能机器人产业蓝图。
    的头像 发表于 04-10 14:06 ?537次阅读

    移远通信:领航AI模型时代,驱动智能机器人产业未来

    当前,随着大模型技术的不断突破,智能产业迎来了重要的发展机遇,成为了产业界热议的焦点。3月13日,由盖世汽车主办的2025第三届
    的头像 发表于 03-13 19:04 ?780次阅读
    移远通信:领航<b class='flag-5'>AI</b>大<b class='flag-5'>模型</b>时代,驱动<b class='flag-5'>具</b><b class='flag-5'>身</b>智能<b class='flag-5'>机器人</b>产业未来

    【「智能机器人系统」阅读体验】2.智能机器人的基础模块

    智能机器人的基础模块,这个是本书的第二部分内容,主要分为四个部分:机器人计算系统,自主机器人的感知系统,自主
    发表于 01-04 19:22

    智能机器人系统》第10-13章阅读心得之智能机器人计算挑战

    阅读《智能机器人系统》第10-13章,我对智能机器人的工程实践有了全新认识。第10章从实
    发表于 01-04 01:15

    【「智能机器人系统」阅读体验】+两本互为支持的书

    如何使用PyTorch进行数字图像处理,它借助摄像头来获取视频的图像信息,然后通过已有的图像识别框架模型经深度学习和优化以达到更精准的识别结果,从而为进一步的执行处理提供数据支持和依据。而《智能
    发表于 01-01 15:50

    【「智能机器人系统」阅读体验】2.智能机器人模型

    近年来,人工智能领域的大模型技术在多个方向上取得了突破性的进展,特别是在机器人控制领域展现出了巨大的潜力。在“智能机器人
    发表于 12-29 23:04

    【「智能机器人系统」阅读体验】1.初步理解智能

    工智能 认知发展机器人学 进化机器人物理体现与互动 五、智能的现代技术方向 另外,随着GPT等大语言
    发表于 12-28 21:12

    【「智能机器人系统」阅读体验】1.全书概览与第一章学习

    ,详细介绍了智能机器人的基础模块,给读者阐明了机器人如何感知环境以及对环境进行交互。 在第三部分,结合最新的大模型技术,探讨了大
    发表于 12-27 14:50

    智能机器人系统》第7-9章阅读心得之智能机器人与大模型

    研读《智能机器人系统》第7-9章,我被书中对大模型机器人技术融合的深入分析所吸引。第7章详细阐述了ChatGPT for Roboti
    发表于 12-24 15:03

    【「智能机器人系统」阅读体验】+数据在人工智能中的价值

    100 倍 。此外,Sim2Real 技术的进步也促进了技能与知识从模拟环境到实际应用的转移。这项技术在虚拟空间中训练机器人AI 系统,使它们能够安全有效地学习任务,而不受现实世界的物理
    发表于 12-24 00:33

    【「智能机器人系统」阅读体验】+初品的体验

    智能机器人系统》 一书由甘一鸣、俞波、万梓燊、刘少山老师共同编写,其封面如图1所示。 本书共由5部分组成,其结构和内容如图2所示。 该书可作为高校和科研机构的教材,为学生和研究人员提供系统
    发表于 12-20 19:17

    智能机器人系统》第1-6章阅读心得之智能机器人系统背景知识与基础模块

    、谷歌的RT系列等前沿产品中展露锋芒。这些突破性成果标志着AI正从虚拟世界迈向物理世界的深度交互。 而研读《智能机器人系统》前六章,我对
    发表于 12-19 22:26

    名单公布!【书籍评测活动NO.51】智能机器人系统 | 了解AI的下一个浪潮!

    机器人全球供应链的分布情况为例,智能机器人的核心元器件(包括 3D 视觉传感器、六维力传感器、微型传动系统、灵巧手与精密力控系统、高性能 驱控关节模组、融合通用大
    发表于 11-11 10:20

    国内首个智能工业机器人领域报告重磅开启!

    9月26日,工博会期间开展的“2024年上海智能机器人前沿发展大会”上,由微亿智造、捷勃特和中国信通院华东分院共同发起并联合编写的《智能工业机器人产品及市场研究报告》正式启动,此报
    的头像 发表于 09-29 09:07 ?710次阅读
    国内<b class='flag-5'>首个</b><b class='flag-5'>具</b><b class='flag-5'>身</b>智能工业<b class='flag-5'>机器人</b>领域报告重磅开启!