康奈尔大学」共找到 5292 篇相关文章

算法论文8

均值至上假繁荣!北新作专挑难题,逼出AI模型真本事

当强化习成模型后训练核心工具,主流方法陷入「均值优化陷阱」,推理能力停滞。北团队提出RiskPO,将风险规避理念融入优化目标,用MVaR+捆绑策略双管齐下,三任务表现优异。

新智元
开源动态8

CVPR 2026 | AI寒武纪时刻?字节世界模型新作,仅靠视觉习真实世界知识

豆包模型团队与北京交通联合提出视觉世界模型 “VideoWorld 2”,无需依赖语言模型,仅靠视觉信息让机器掌握复杂能力。它能完成复杂手工任务,成功率远超主流模型,代码与模型已开源。

机器之心
算法论文7

AI在「赚钱锦标赛」夺冠,比人类还会做生意!躺赚时代要来了?

研究人员提出自动售货机运营模拟环境Vending - Bench,测试模型智能体管理业务能力。实验显示不同模型性能方差,Claude 3.5 Sonnet净资产表现最佳,人类基线在可靠性上表现较好,各模型长周期表现波动

新智元
算法论文8

五倍推理加速,激发自回归潜能,苹果新工作让LLM预测未来

近年来自回归训练方法成语言模型主流范式,但推理阶段计算开销。苹果研究人员开发框架,让预训练自回归模型多 token 预测,代码和数任务推理加速达 5.35 倍,一般任务约 2.5 倍。

机器之心
算法论文8

ICML 2026 | 华为GTS提出AI训练数据新方法,Amazon/Google作者团队「光速跟进」:难度自适应训练正在成为新范式

华为GTS研发部AI数据团队提出EDCO方法,将样本难度估计与动态课程编排引入领域模型微调。该方法用推理熵动态编排训练课程,让模型面对最有习价值的样本,已被ICML 2026接收。

机器之心
新闻资讯8

陶哲轩最新演讲:数正在进入“工业时代”

当地时间7月24日,菲尔兹奖得主陶哲轩在2026年国际数会上发表演讲,指出AI参与数研究,或使数站在类似历史节点,研究方式和价值体系受挑战,还探讨了AI对数研究各方面的影响及应对方向。

DeepTech深科技
开源动态8

R-HORIZON:长程推理时代来临,复旦NLP&美团LongCat重磅发布LRMs能力边界探测新范式

复旦与美团LongCat Team联合推出R - HORIZON,它是首个系统性评估与增强LRMs长链推理能力的方法与基准。提出Query Composition方法构建评测基准和训练数据,评测发现主流模型长链推理性能断崖式下降,还分析出三瓶颈,训练后模型性能双重提升。

机器之心
算法论文8

模型「越用越快」!SpeedupLLM首次验证,降56%推理预算

Emory研究者提出SpeedupLLM框架,利用动态计算资源分配和记忆机制,使LLM处理相似任务时推理成本降56%、准确率提升,论文系统性验证了LLM“越用越快”,为AI模型发展提供新思路。

新智元
新闻资讯7

LeCun出局,Meta变天!Llama 4翻车清洗,「院派」败退

LeCun宣布年底离开效力12年的Meta,创立专注「世界模型」的AI公司。Llama 4翻车成其离职导火索,他的离去意味着院派在Meta的AI战略中被边缘化,也预示硅谷AI路线之争进入新阶段。

新智元
新闻资讯7

The Batch: 880 | 用 AI 2 小时 vs. 跟老师 6 小时

Alpha School用AI驱动教,将传统6小时课程替换为2小时个性化习,让习速度翻倍,生考试成绩优异。但部分教育委员会拒绝其分校申请,批评者称缺乏严格证据。此外,美国多地也在进行AI教育尝试。

DeeplearningAI