「多模态智能」共找到 4158 篇相关文章
不再“纸上谈兵”:大模型能力如何转化为实际业务价值
InfoQ《极客有约》X AICon 直播栏目邀华为云郑岩、蚂蚁集团杨浩、明略科技吴昊宇,探讨大模型驱动业务提效。分享场景探索、技术落地经验,如选模型考量因素、AI Agent 创新等,还提及 MCP 应用与未来展望。
谷歌开源移动端AI自动化测试神器
本文介绍谷歌最新开源的移动端AI自动化测试工具ARTEMIS,它可将自然语言指令转化为Android自动化操作,支持跨App测试、多模态定位,在AndroidWorld基准评测中取得99%+任务完成率,提供多场景使用方式,可一键快速上手。
GPT-6 Astra 省 Token & 使用技巧大全
本文原创分享GPT-6 Astra的Token节省与实战使用技巧,通过实测对比不同模型搭配的配额消耗效果,给出排雷指南,还介绍了一款开源工具可将普通ChatGPT网页版爆改成全功能Codex,干货充足实用性强。
最懂科学的开源基础大模型『书生-S2』发布:科学能力比肩顶尖闭源,通用性能居开源第一梯队
上海人工智能实验室在2026浦江创新论坛发布开源基础大模型书生-S2,该模型科学能力比肩顶尖闭源模型,通用能力居开源第一梯队,创新架构支持专业知识持续扩展,强化长程科研与智能体能力,可为真实科研任务提供支撑。
从1000通到1.5万通,百融智能的「硅基客服」真正开始「上岗」
今年7月,一家头部物流企业和大型综合类头部券商上线百融智能的AI客服,业务量和部署规模增长显著。百融智能正战略升级,以新一代AICC智能联络技术向多行业拓展,其创始人张韶峰分享了相关思考与技术优势。
怎么量化机器人数据价值?ATHENA将影响函数扩展到十亿参数VLA,313×加速筛选高价值数据
具身智能进入数据scaling时代,VLA模型训练中数据并非越多越好。上海交大同济等校团队提出ATHENA框架,将影响函数扩展到十亿参数VLA模型,解决计算和筛选难题,实现313倍加速,实验证明其用更少数据获更好效果。
国内首套:港中文团队发布7模态人体动作数据集,揭开大模型理解能力短板
港中文邢国良教授团队博士生蒋思阳完成 CUHK-X 多模态人体动作数据集,成果被 ACM MobiSys 2026 接收。用其测试主流大模型,发现理解人类动作平均正确率仅四成。该数据集数据收集方法反常规,还开展了基准测试。
ACL 2026|打破推理同质化!阿里达摩院新作让RLVR从重复采样走向有效探索
阿里达摩院智能决策团队提出面向RLVR后训练的探索增强框架I²B-LPO,改进rollout策略,在关键节点生成更具区分度的推理轨迹,结合信息瓶颈自奖励机制,在多个数学基准上提升准确率与语义多样性。
当200位具身从业者被拉进同一个屋子
量子位等联合发起沙龙,近200位具身从业者探讨具身智能从实验室走进物理世界的问题。乐聚工程师指出具身数据瓶颈,蚂蚁灵波郑可成介绍模型,上海交大李永露分享评测基准,圆桌对话探讨数据挑战与破局路径。
重磅!Anthropic又一个平台级产品炸场:Harness难题一次性解决,把Agent宠物变成牲口
Anthropic推出Claude Managed Agents,一套为云端大规模构建和部署智能体设计的API套件,已在Claude Platform上线公测。它全托管基础设施,专为Claude模型优化,多家企业已在生产环境使用,还同步发布工程博客解释架构设计思路。