「AI学习」共找到 10492 篇相关文章
仅需152个样本,性能提升48%:Memory-R1如何重塑Agent记忆能力?
这篇文章解读论文Memory - R1,其由多所高校研究团队完成,旨在解决LLM在长对话和多轮任务中的‘记忆难题’。通过强化学习让LLM学会管理记忆,用152个问答对训练,大幅超越现有基线模型。
Cursor or Claude Code ?— 这道题怎么选
文章深度对比Cursor和Claude Code两款AI编程工具,介绍其核心功能、适用场景。经案例分析,指出Cursor快但草率,Claude Code慢却精准。还给出使用心得,建议开发者依任务灵活选择或结合使用。
一个重要的发布被忽略!Decart发布实时“Sora”,直播/游戏业迎来新变革
Decart推出全球首个实时、无限长度的AI视频模型MirageLSD,基于独创的“实时流扩散”技术。其响应时间低于40毫秒,攻克了“错误累积”和实现实时响应两大难题,还计划拓展应用及升级功能。
ICML 2025 | 千倍长度泛化!蚂蚁新注意力机制GCA实现16M长上下文精准理解
在大语言模型发展中,长文本建模挑战大。蚂蚁研究团队提出注意力机制GCA,可端到端学习检索相关片段,实现超长序列处理与泛化,其Triton kernel实现已开源,论文被ICML 2025接收。
亚历山大王回应一切:LeCun、Manus,“我的父母都是中国人”
亚历山大王加入Meta近一年后首次公开回应争议。他谈了Muse Spark技术逻辑、Meta超级智能实验室架构等,还分享八卦,如与奥特曼决裂代价、小扎抢人真相,认为AI终局未开始,科技行业将分层。
FUTURUS未来黑科技徐俊峰:侧翼突围,构建AR全栈解决方案|甲子光年
2026崇礼论坛上,FUTURUS未来黑科技徐俊峰指出AI产业面临瓶颈,创业者应‘侧翼突围’。他认为以汽车挡风玻璃为介质的AR技术是数据闭环关键切口,还描绘了AR全栈解决方案赋能车厂的商业蓝图。
什么都不做就能得分?智能体基准测试出现大问题
随着AI智能体走向实际应用,其基准测试变得至关重要。但现有基准测试问题多,如WebArena判错答案、τ - bench给无操作智能体高正确率。文章提出有效性判据和ABC清单,还揭示主流基准测试诸多问题。
模型即 Agent 的含金量:Kimi深度研究功能详评
作者分享Kimi深度研究功能体验。其基于端到端自主强化学习技术,会开源模型。在测试中,分析Labubu爆火原因、检索小米发布会内容,展现出强逻辑分析、搜索准确性和数据处理能力,可视化网页也出色。
伯克利斯坦福联手造出「科研预言家」:77%准确率押注研究想法前景
伯克利和斯坦福团队让GPT - 4.1变身「科研预言家」,从顶会提取想法对比案例训练,不借助实验验证,靠推理押注。其在公开题库测试、人类专家团战等测试中表现出色,还能预测AI新点子。
OpenAI总裁:AGI时代来了!GPT-6已能自主干活24小时
本文报道OpenAI总裁Greg Brockman在a16z访谈中的发言,Brockman宣布已进入AGI时代,介绍GPT-6的能力跃升,分享OpenAI在AGI发展、AI安全对齐等方面的最新判断与动作。