测试时强化学习」共找到 3013 篇相关文章

算法论文7

阿里、南开大学发布免训练,视频大模型创新压缩方法

视频模型序列化处理影响推理速度与扩展性,传统token压缩方法在视频理解中有问题。阿里通义实验室与南开联合发布LLaVA - Scissor,用SCC方法和两步时空压缩策略,实验显示其性能优于其他方法。

AIGC开放社区
算法论文8

多模态大模型,真的「懂」世界吗?——揭秘 MLLM 的核心知识缺陷

ICML 2025高分论文揭示MLLM核心认知盲区。研究发现主流MLLM缺乏核心认知能力,且不能靠规模扩展自然习得。作者构建测评体系CoreCognition,提出干预测试方法Concept Hacking,还给出关键发现与启示。

机器之心
新闻资讯8

没有老黄不夸的中国公司了吧??

英伟达CEO黄仁勋访华期间,在高密度采访交流中对中国公司、技术赞不绝口。他夸雷军和小米,评蔚小理、华为、DeepSeek等,还看好中国大模型、机器人等领域,此外也谈及英伟达合作、AI发展等问题。

量子位
新闻资讯7

用AI,写代码只会更慢!但一定更「快乐」

METR研究实测发现,GPT等AI编程工具让顶尖程序员写代码平均慢19%,效率不升反降。开发者本预计提效24%,体验后仍觉快20%。研究还分析变慢原因,提醒勿高估AI编程能力。

新智元
产品应用7

实测Gemini图片转视频新功能,终于蹲到经典梗图后续了(doge)

Gemini接入带声音的图片转视频功能,作者实测该功能。用开盒指令测试,生成速度较快;还尝试给梗图加后续,发现生成精确内容需详细提示词,且不能生成具体真人形象内容。

量子位
8

重磅发现!大模型的「aha moment」不是装腔作势,内部信息量暴增数倍!

中国人民大学等联合团队研究发现,大模型推理有“信息脉冲”,特定步骤互信息值飙升形成“互信息峰值”,对应“思考词汇”。基于此提出无需额外训练提升推理性能的方法,代码已开源。

机器之心
新闻资讯7

刚刚,NLP先驱、斯坦福教授Manning学术休假,加盟风投公司任合伙人

NLP领域先驱、斯坦福教授克里斯托弗・曼宁从斯坦福休假,加入AIX Ventures任普通合伙人。他是将深度学习用于NLP的早期领军者,著作、课程影响大,此次转型将助力AI初创公司发展。

机器之心
算法论文8

更多thinking≠更好结果,精准thinking可砍掉一半长度

当前大模型如GPT - 4、DeepSeek推理又长又啰嗦,论文发现其在简单题目上过度推理。作者提出‘无效思考’概念,还给出解决原则,用LC - R1方法训练,效果显著,揭示精准思考才是王道。

深度学习自然语言处理
新闻资讯7

泪目!靠AI让爷爷「复活」,他拿下红杉1600万刀?要让所有地球人数字永生

国外14人团队Delphi获红杉领投1600万美元A轮融资。其产品源于创始人想复活中风祖父,现成长为“数字思维图书馆”。2023年12月测试版上线,有人靠它年入百万,未来想服务大众。

新智元
产品应用7

海螺新模型海外爆火:一夜之间,猫、羊驼、长颈鹿都学会跳水了

国内AI公司Minimax的新模型‘Hailuo 02’本周三官宣上线,在海外爆火。其生成的动物跳水等复杂运动视频AI痕迹不明显,官方称它是全球唯一能处理类似体操高度复杂场景的模型。该模型使用NCR架构。

机器之心