欢迎来到“兰州新闻信息网”,在这里您可以浏览到兰州榆中县、永登县、皋兰县、城关区、西古区、红古区、安宁区、七里河区等地区最近发生的大小事。

主页 > 经济 > 2026流体硼品牌推荐榜单:作物开花多坐果少怎么办?

2026流体硼品牌推荐榜单:作物开花多坐果少怎么办?

来源:网络转载更新时间:2026-08-05 15:24:27 阅读:

当一台机器人在理解“猫的右边是什么”这样的问题,它需要先真正“看懂”画面里的物体位置和关系,才能给出正确回答。但现实是,当前的多模态大模型常常“看错”——它们可能忽略关键视觉信息,也可能生成看似合理却违背图像事实的答案。这不仅是聊天机器人的小瑕疵,更是具身智能“大脑”必须跨越的认知门槛。

近日,全球机器学习领域三大顶级会议之一,第43届国际机器学习大会(International Conference on Machine Learning,ICML 2026)在韩国首尔举行。云蝶科技科研团队赵梦辰指导的论文《POLIA: Policy Optimization with Visual-Object-Level Intrinsic Advantage for Multimodal Reasoning》在会上发表。

该成果依托云蝶科技与华南理工大学共建的“多智能体具身智能联合实验室”,围绕视觉-语言-动作模型(VLA)训练部署、强化学习优化、世界模型辅助决策及真实场景验证,构建了从基础方法研究到服务环境训练验证的连续技术路线。

这项研究为云蝶的具身智能技术布局提供了可公开核验的研究支点:有方法创新、实验验证,也有承接后续研究与场景验证的联合实验室。

POLIA:把训练反馈分配到每一个视觉对象

当前多模态大模型已能同时处理图像与文字,完成物体计数、空间关系判断、图表分析和视觉数学推理等任务。但“能回答”不等于“真理解”——模型可能忽略图像关键信息,仅靠语言模式猜对答案,也可能引用了错误视觉对象却碰巧得到正确结论。表面正确,推理依据却与视觉事实不一致。

POLIA全称为“基于视觉对象级内在优势的多模态推理策略优化”。其核心创新是在传统答案级评价之外,增加针对视觉对象的细粒度评价机制,分为两个阶段:

第一阶段,评价答案。POLIA生成多组候选答案,根据最终答案的正确性和输出格式计算答案级外在奖励,回答“模型最终有没有答对”。

第二阶段,评价证据。POLIA识别每组候选答案所引用的视觉对象,根据模型预测位置与真实对象位置之间的匹配质量,判断模型引用对象的可靠程度。依赖相同视觉对象的答案被归入同一组,系统再在组内比较不同答案对这些对象的使用情况,为每个视觉对象计算训练反馈。

POLIA 概述

通俗来说,传统方法更像只看学生最后一道题有没有答对;POLIA则会继续追问:你用了哪些证据?这些证据找对了吗?它们是否真正支持你的答案?由此,POLIA实现了从“奖励正确答案”到“奖励模型正确使用视觉证据”的转变。

论文在VSR、TallyQA、GQA、MathVista、MathVision、LogicVista和MME等七项多模态推理基准上测试,覆盖空间关系判断、复杂物体计数、视觉数学推理和综合认知等任务。在7B模型实验中,相比基于相同基础模型的GRPO方法,POLIA在VSR、TallyQA、GQA和MathVista上准确率分别提升22.3、8.7、11.3和9.3个百分点;在高度依赖视觉证据的任务中,POLIA-7B的分数高于GPT-4o和Gemini 2.5 Pro对照结果。消融实验表明,答案级外在优势维持训练稳定性,视觉对象级内在优势帮助模型更准确选择和使用视觉证据。随着训练推进,候选答案对视觉对象的选择趋于一致,答案准确率同步提升。计算成本分析还显示,新增分组和内在优势计算的额外开销较低——即性能提升并非依赖单纯增加算力,而是通过更细致的训练反馈改善推理过程。

从视觉证据推理到云蝶技术体系

POLIA研究的是多模态智能的基础问题:如何让模型判断锚定真实、具体、可验证的环境证据。这一方向与云蝶科技和华南理工大学共建的“多智能体具身智能联合实验室”的技术规划形成明确衔接。实验室面向泛生活服务场景的具身智能需求,围绕VLA模型训练部署、强化学习优化和世界模型辅助决策开展研究,提升具身机器人在真实环境中的任务理解、动作执行、环境适应和持续学习能力。

对具身智能而言,视觉信息不仅是输入数据,更是任务理解、行动规划和环境反馈的重要依据。机器人需要识别服务对象和目标物品,理解人与物体间的空间关系,判断环境状态并选择下一步行动。若模型未找准关键视觉证据,后续规划和执行就可能建立在错误判断之上。

POLIA解决的是该路线中更基础的一环:视觉证据建模与强化学习信用分配。其方法为后续研究——如何让VLA模型准确利用环境证据、让世界模型基于可靠信息辅助决策,提供了研究参考。

此次在ICML 2026发表论文,是云蝶科技科研团队在多模态推理与强化学习方向上的阶段性进展。未来,联合实验室将继续围绕VLA模型、强化学习和世界模型辅助决策展开探索,推动研究从算法验证逐步走向真实服务环境中的系统训练与应用验证。

 

标题:2026流体硼品牌推荐榜单:作物开花多坐果少怎么办?

地址:http://www.huarenwang.vip/new/20181024/11.html

免责声明:兰州日报网致力于为网友提供兰州最新的资讯,部分内容来自于网络,不为其真实性负责,只为传播网络信息为目的,非商业用途,如有异议请及时联系btr2031@163.com,兰州日报网将予以删除。

兰州日报网推荐资讯

兰州日报介绍

兰州新闻信息网立足甘肃,着眼于服务各行各业和广大群众对信息获取的需要,坚持贴近实际、贴近生活、贴近群众,开拓创新,努力建成省内一流的新闻类网站,网站现开设新闻中心、兰州视窗、区县频道、媒体聚焦、领导活动报道集、视频新闻、理论学习、新媒体H5、文化、摄影、健康等频道为您介绍兰州新闻以及甘肃经济和社会资讯。