感知 - 驱动算法」共找到 1425 篇相关文章

算法论文7

VL-LN Bench:模拟「边走边问找具体目标」的真实导航场景

上海人工智能实验室等研究者完成VL - LN Bench,模拟真实导航场景。它构建自动化数据收集管线,依托InternVLA - N1训练评测。结果显示主动对话可提升表现,但当前方法在实例感知对齐等环节有短板。

机器之心
新闻资讯8

OpenAI发布GPT-5.4:首个原生接管电脑通用模型

OpenAI发布GPT-5.4及满血版GPT-5.4 Pro,主打专业生产力。它具备原生电脑操作能力,视觉感知、职场任务表现提升,幻觉问题被压制,代码能力强,工具调用机制优化,已在ChatGPT等全量上线,API定价上调。

AI寒武纪
新闻资讯8

1万块GPU砸向欧洲!老黄怒怼AI末日论:全球首个工业AI云来了

巴黎GTC大会上,黄仁勋表示AI是伟大平等工具,驳斥AI致大裁员预测。英伟达卖1万块GPU建工业AI云,还宣布DGX Lepton项目。此外回顾AI发展,从感知到具身智能,介绍其应用及加速计算等成果。

新智元
产品应用7

从提需求到部署发布,全AI全自动化后,研发效能全面跃升

文章介绍腾讯在研发中推进AI全自动化,将自动化向上下游环节延伸,分L1、L2、L3阶段演进。阐述了面临的挑战及应对举措,分享人机协同和全自动化交付实践,展示效果数据,展望未来双轮驱动体系。

腾讯技术工程
开源动态8

蚂蚁发布全球首个视频-动作世界模型,开源即刷新世界纪录

从Sora惊艳亮相到谷歌开放Genie 3线上体验,世界模型从概念走向交互世界。蚂蚁旗下蚂蚁灵波开源全球首个视频 - 动作世界模型LingBot - VA,可驱动机器人完成复杂操作,解决长时漂移等问题,还提出工程化解法。

MacTalk
推荐文章7

深度长文解读 “世界模型” :在虚构与真实交接之处凝视未来

本文深入解读“世界模型”,虽无明确定义,但从目的出发分为表征和生成两类。前者含生物大脑、视觉和语言中心预测;后者有基于规则模拟和数据驱动生成。还探讨LLM是否为世界模型,指出各类模型相辅相成。

AI科技评论
开源动态8

社区供稿 | 阿里国际Ovis2.5重磅发布:以小博大,刷新开源模型性能新高度

阿里国际发布多模态大模型Ovis2.5,在OpenCompass综合得分提升,保持SOTA水平。它在原生分辨率视觉感知等三方面突破,有9B和2B两版本,代码、模型等资源已开源,技术原理涉及架构、训练与数据。

Hugging Face
新闻资讯8

陶哲轩经费被断供,在线发帖自证数学有用

菲尔兹奖得主陶哲轩就职的UCLA科研经费被冻结,个人研究及应用数学研究所IPAM失去资金支持,还遭网友质疑其学术成果价值。他开新帖以“压缩感知”研究为例,力证数学研究回报,并将视野扩展到AI大模型。

量子位
新闻资讯7

苹果拆解AI大脑,推理模型全是「装」的?Bengio兄弟合著

苹果最新研究揭示大推理模型(LRM)在高复杂度任务中普遍‘推理崩溃’。即便给予明确算法提示,模型亦无法稳定执行,暴露推理机制的局限性。研究还通过多种实验环境分析了模型在不同复杂度问题中的表现。

新智元
开源动态8

攻克结构化长文档检索难题!新框架让模型告别“结构性失明”

SEAL团队推出全新对比学习框架SEAL,通过带结构感知和元素对齐,将文档宏观层级结构和微观元素语义融入Embedding空间,提升模型对结构化数据的理解。在BGE - M3模型上提升了MRR@10指标,还开源了万级字数长文档数据集。

量子位