模长感知」共找到 953 篇相关文章

开源动态8

「被动感知」到「理解接触」!它石智航重磅发布OmniVTA视触觉世界

它石智航联合六大顶尖机构推出OmniVTA视触觉操作框架和OmniViTac大规视触觉数据集。该框架核心是从被动感知到主动预测触觉,通过多块协同让机器人有预测、理解和修正能力,实验表现优。

新智元
算法论文8

让AI生成视频「又又快」:Rolling Forcing实现分钟级实时生成

南洋理工大学与腾讯ARC实验室联合研究,由博士生刘坤昊等完成,提出Rolling Forcing方法,通过滚动窗口联合降噪等创新设计,突破实时视频生成瓶颈,实现分钟级实时生成,还支持交互控制,但仍有优化方向。

机器之心
新闻资讯8

马斯克将用最强Grok 5,挑战LOL最强战队T1!

马斯克让Grok 5戴「纯视觉感知」与「拟人延迟」镣铐挑战LOL传奇战队T1。这是终极图灵测试,AI像人一样感知与推理。对决为特斯拉Optimus练兵,若AI看懂团战,就能理解现实世界。

新智元
算法论文7

又一推理新范式:将LLM自身视作「改进操作符」,突破思维链极限

Meta等机构研究者将LLM视为「思维」改进操作符,探究并行 - 蒸馏 - 精炼(PDR)推理方法。实验显示,PDR在数学任务中提升准确率,还训练8B型让推理方法更适配,减少训练与部署的不匹配。

机器之心
算法论文8

清华刘知远团队论文:最小化结构改动,短文本到文本丝滑升级 | ICLR 2026

大语言型发展中,上下文度成关键瓶颈,主流架构计算开销大。清华刘知远团队提出《InfLLM-V2: Dense-Sparse Switchable Attention for Seamless Short-to-Long Adaptation》,提出可切换注意力框架,为上下文研究提供新思路。

AI科技评论
算法论文7

型宣称的“百万字处理能力”是真本事,还是营销噱头?LongCodeBench揭露真相

近年来大型号称有百万字处理能力,但这是真本事还是噱头存疑。论文用LongCodeBench测评工具揭开上下文型真实表现,测试顶尖型发现文本能力‘翻车’,还分析了上下文难的原因及面临的瓶颈。

深度学习自然语言处理
开源动态8

LLM文本内卷,谁是真英雄?告别跑分玄学,我们需要一把“公道秤”

OpenNLG Group做了统一上下文评估框架LOOM - Scope,兼容主流benchmark、model和上下文加速方法。该框架围绕BENCHMARK、DEPLOYMENT和EVALUATOR三大核心块,还提出LOOM - Bench应对评估成本制约。

深度学习自然语言处理
算法论文8

夜间感知新突破!北航等提出红外主导的高效目标检测方案 | ECCV'26

在复杂视觉场景中,传统RGB - IR多态检测方法在低照度等场景下因RGB退化影响检测效果。北航等团队提出的InfraNet,以红外为主,用质量感知机制控制RGB引导,在多数据集取得强竞争力结果。

新智元
产品应用8

AI视频进入蒸汽机时代

百度蒸汽机 2.0 迎来重磅升级,推出行业首个通用 AI 视频生成功能,突破时限制,引入交互式需求表达功能。它解决了传统视频生成痛点,在多个维度优化创新,还带来商业应用新可能。

机器之心
算法论文8

ICLR 2026 | LongHorizonUI:让 GUI 智能体不再"半途而废"——面向链路任务的统一鲁棒自动化框架

近年来,基于多态大语言型的GUI智能体在自动化操作上虽有进展,但任务步数超10 - 15步时成功率断崖下跌。研究人员提出LongHorizonUI框架,构建LongGUIBench评测基准,推动GUI自动化在复杂场景落地。

机器之心