存在论」共找到 8256 篇相关文章

算法论文8

直接从像素到单词:这个原生大模型统一单图、多图、视频和空间智能

南洋理工大学等团队推出NEO - ov模型,挑战传统「视觉编码器 + 大模型」范式,直接从原始像素学语言。它多任务表现出色,尤其空间智能突出,但OCR等方面有短板,展现原生多模态建模潜力。

机器之心
算法论文8

ICLR 2026 | LongHorizonUI:让 GUI 智能体不再"半途而废"——面向长链路任务的统一鲁棒自动化框架

近年来,基于多模态大语言模型的GUI智能体自动化操作上虽有进展,但任务步数超10 - 15步时成功率断崖下跌。研究人员提出LongHorizonUI框架,构建LongGUIBench评测基准,推动GUI自动化复杂场景落地。

机器之心
新闻资讯7

AI 编程冲击来袭,程序员怎么办?IDEA研究院张磊:底层系统能力才是护城河

AICon全球人工智能开发与应用大会上,IDEA研究院张磊接受专访,剖析多模态智能体落地路径,分享工业界平衡研究与产品的见解,还为年轻人AI浪潮中发展给出建议,指出底层系统能力是关键。

InfoQ
开源动态8

首个面向科学任务、真实交互、自动评估的多模态智能体评测环境,ScienceBoard来了

ScienceBoard是首个面向科学任务、真实交互、自动评估的多模态智能体评测环境。它集成多领域科研软件,构建科研任务集合,评估智能体科学任务上的表现,发现现有模型科研工作流中远未成熟。

机器之心
开源动态8

Qwen-AgentWorld:一个语言世界模型,模拟七大Agentic领域

今天正式发布 Qwen-AgentWorld,它是首个原生语言世界模型,能七大领域模拟智能体交互环境。同步发布 AgentWorldBench 评测基准。Qwen-AgentWorld 经三阶段训练,评测中表现出色,还探索两种范式增强通用智能体能力。

千问大模型
算法论文8

当SFT遇上RL:基于样本学习阶段的动态策略优化机制

大模型推理能力增强研究中,SFT和RL两种后训练范式难有效融合。研究团队提出DYPO动态策略优化方法,先判断样本学习阶段再匹配优化路径,多场景实验中表现出色,不过有实验边界。

量子位
开源动态8

ICCV25 Highlight|格灵深瞳RICE模型狂刷榜单,让AI「看懂」图片的每个细节

格灵深瞳公司灵感团队自研的视觉模型基座RICE(MVT v1.5)刷榜多项视觉任务,ICCV25获Highlight荣誉。它延续MVT系列理念,提升图片内部视觉特征差异性,多任务验证中表现优异。

机器之心
开源动态8

微软开源浏览器Agent,可实时跟踪、控制智能体,超4000颗星

微软官网开源用于浏览器网络任务的Agent——Magentic - UI,基于Magentic - One开发,支持人机协同。GAIA测试显示其能提升任务完成率和准确率。它以人为本,有独特机制,框架含多阶段,Github超4000颗星,支持MIT许可证商用。

AIGC开放社区
推荐文章8

从 Rule、Spec 到 Harness:AI Coding 的渐进式建设路径

作者分享帮团队落地AI Coding经验,指出试点易但推广难,瓶颈接收端。介绍从Rule、Spec、Loop到Harness的渐进式建设路径,各层前后相依,逐层收紧控制面,助AI工程体系稳定交付。

phodal
开源动态8

摩尔线程算法一鸣惊人,图形学顶会夺银!已开源

12月17日,SIGGRAPH Asia 2025上,摩尔线程凭借自研技术LiteGS3DGS重建挑战赛中获银奖。3DGS是革命性3D场景表示与渲染技术,摩尔线程开源3DGS基础库LiteGS,实现全链路协同优化。

量子位