研究任务」共找到 3561 篇相关文章

算法论文7

腾讯LLM团队:对下一个 Token 预测的深入剖析,多样性 or 精准度?

最新研究证实RL能增强LLM推理,但成效受限预训练token分布。腾讯LLM部把交叉熵重写成单步策略梯度,用超参压熵,为RL打造‘低熵高信号’起点,经实验验证低熵模型优势明显。

PaperAgent
算法论文8

刚刚,智元提出SOP,让VLA模型在真实世界实现可扩展的在线进化

智元具身研究中心提出SOP框架,可让VLA模型在真实世界实现可扩展的在线进化。它是颠覆性的机器人学习新范式,整合在线、分布式和多任务机制,构建闭环打破机器人认知时间边界。实验显示其性能优越。

机器之心
开源动态8

NeurIPS 2025 | 蚂蚁CGM:图融合架构重塑代码大模型,探索非 Agent 新范式

在NeurIPS 2025上,蚂蚁将展示Code Graph Model (CGM)。它把代码库图结构集成到开源LLM,开启新范式,在代码库级任务上以非Agent方案登顶开放权重模型榜首,解决了复杂软件工程的Agent依赖难题。

PaperAgent
新闻资讯8

英伟达周末双炸!CUDA二十年最大更新,顺手屠榜AGI比赛

本周末英伟达有两大动作。一是推出CUDA 13.1,这是CUDA平台诞生二十年来最大更新,引入CUDA Tile编程模型等。二是在Kaggle ARC Prize 2025竞赛中,团队用4B小模型变体夺冠,靠合成数据等策略。

新智元
新闻资讯7

智能流体力学青年学者论坛第28讲:伦敦城市大学Manolis Gavaises教授

智能流体力学青年学者论坛第28讲于2025年12月4日9点至12点在航空楼A110举办。多位学者分享成果,如Manolis Gavaises用机器学习建模多相流;方波李研究超临界流体湍流;陈杰石提出大涡模拟子网格模型等。

力学与人工智能
产品应用7

谷歌Agent正在憋大招:AI科学家内测,锦标赛制“炼”想法,一次跑40分钟

谷歌正为Gemini Enterprise开发多智能体系统,能扮演联席科学家提炼想法,实现研究自动化。工作时以锦标赛形式评估想法,一次运行约40分钟,还准备了“想法生成”“联席科学家”等智能体。此外还有“与文档对话”功能。

AI寒武纪
算法论文8

让AI生成视频「又长又快」:Rolling Forcing实现分钟级实时生成

南洋理工大学与腾讯ARC实验室联合研究,由博士生刘坤昊等完成,提出Rolling Forcing方法,通过滚动窗口联合降噪等创新设计,突破实时长视频生成瓶颈,实现分钟级实时生成,还支持交互控制,但仍有优化方向。

机器之心
新闻资讯7

4倍速吊打Cursor新模型!英伟达数千GB200堆出的SWE-1.5,圆了Devin的梦!实测被曝性能“滑铁卢”?

Cognition推出全新AI编码模型SWE-1.5,专为软件工程任务设计,运行速度快,在基准测试中成绩良好。它基于GB200芯片训练,有定制编码环境,开发有新战略,还与Cursor新模型Composer对比引发关注。

InfoQ
新闻资讯7

被困住的日本数据中心

日本一座合资建设的数据中心是AI战略象征,承载训练大模型任务。但生成式AI兴起让数据中心成“电老虎”,与日本环保目标冲突。日本在发展AI与碳中和间艰难平衡,面临能源结构等多方面困局。

芯师爷
新闻资讯7

田渊栋被Meta卸磨杀驴,但全网疯狂发offer!OpenAI冲来抢人了

Meta裁员风暴扩散,FAIR研究科学家田渊栋等被裁。田渊栋入职十年多,成果亮眼,却在协助处理Llama 4相关事务后被裁。此外,不少刚入职的博士也遭殃。同时,Meta还用AI取代人工审核。

新智元