「视频推理数据集」共找到 4969 篇相关文章
北大DeepSeek论文或预定ACL Best Paper!梁文锋署名
北大DeepSeek联合发布的NSA论文已被ACL 2025录用且评分高,有望冲击最佳论文。该技术革新传统注意力机制,提升算力效率,是长文本处理的突破。此外,张铭教授团队还有多篇论文上榜。
MIT博士爆火论文造假,学校官宣撤稿!被骗诺奖导师亲手举报,愤而割席
去年MIT二年级博士论文轰动学术圈,展示AI使科学家生产力大幅提升,有望登顶级期刊。现因数据可能伪造被学校要求撤稿,导师“大义灭亲”,此前UCL教授就提出过质疑。
科大讯飞研发总监王磊磊将在 AICon 上海分享多模态降噪技术的实践与应用
5月23 - 24日AICon上海大会将聚焦AI前沿与产业落地。科大讯飞王磊磊将分享《复杂场景下的语音交互,多模态降噪技术的实践与应用》,介绍基于多模态融合的降噪技术体系及其在智能硬件中的应用。
快手&中科院 | 提出多模态奖励模型:R1-Reward,比SOTA模型提升5%-15%!
多模态奖励模型对提升多模态大语言模型表现至关重要,但现有强化学习算法用于训练存在问题。快手、中科院等团队提出 R1 - Reward,在基准上比 SOTA 提升 5% - 15%,还在快手业务场景成功应用。
稀土分离最难的一步,美国公司想用量子计算和机器人实验室来解决
稀土分离是稀土供应链中技术资本门槛最高的环节,传统方法依赖大量试错效率低。美国稀土公司USA Rare Earth联合两家科技公司,计划用量子机器学习加自动化实验室研发新型萃取剂,优化分离工艺,验证量子方法的工业价值。
实测Qwen3.8-Omni-Flash:全模态Agent有了“白菜价”
本文是对千问最新推出的Qwen3.8-Omni-Flash全模态模型的实测,该模型大幅降低全模态Agent使用成本,API价格远低于竞品,开放1M上下文免费测试额度。
复杂的Harness Evolution,甚至不如多跑几遍
本文解读AI2与华盛顿大学最新研究,针对热门Agent Harness Evolution方向,通过公平对照实验检验方法真实收益,戳破研究误区,引发对Agent评估标准的反思。
对话 xLean 薛轲翰:扫地机产品远没有到头,清洁机器人可以是 Family Agent 的起点
这是Founder Park对xLean创始人薛轲翰的专访,薛轲翰提出通用家庭机器人应从真实场景切入,而非诞生于实验室,xLean推出双形态洗地机器人TR1,以清洁为起点布局Family Agent生态,已获得不错的市场反馈。
刚刚,中国AI天团杀向RSI!1分钟预测全球天气、20分钟手搓OS
本文报道上海人工智能实验室等多家机构联合发布智能体模型Atria Dawn Preview,该模型可1分钟预测全球天气、20分钟搭建MiniOS,团队同时分析AI研发中的人机分工,披露最新协作数据。
1.6K Star!阿里开源 zg:一条命令解决 Agent 时代的本地检索难题。
AI Agent 用 ripgrep 检索常遇难题,因代码命名和自然语言有‘词汇鸿沟’。阿里开源的 zg,将三种搜索能力整合进 CLI 工具,可用于终端与人机交互,还介绍了其安装、建索引及搜索的方法。