「R1论文」共找到 2685 篇相关文章
综述连arXiv都不给发了?最严新规出台:被会议、期刊接收才行,workshop都不行
arXiv出台新规,计算机科学分类下综述和立场论文须先被正式期刊或会议接收且完成同行评审,投稿时要提供证据。因此类文章数量多、质量差,新规引发热议,有人认为太严。
ICML 2026|如何对Multi-Agent系统进行过程评估?重新认识多智能体系统中的Orchestrator
来自南京大学NLP实验室的ICML 2026论文指出,当前主流多智能体架构中,系统失败常源于负责全局调度的Orchestrator失去对任务的掌控。论文提出相关框架和方法对其进行分析与评估。
物理学家让芯片速度暴增1000倍,你的手机可能也要变快1000倍了
物理学家操控1T - TaS₂量子材料,实现比传统硅基芯片快1000倍的开关速度。硅基芯片有物理极限,而此量子材料切换仅需1皮秒。虽距应用尚远,但为电子设备带来新可能。
一封来自Transformer之父的分手信:8年了!世界需要新的AI架构
Transformer之父Llion Jones在TED AI大会上称要把对Transformer的爱好调成「低电量模式」。他认为大量资金与人才涌入使研究被「收窄」,大家只顾卷参数、抢发论文,没人探索新架构,他呼吁找回好奇心。
语音分离最全综述来了!清华等团队深度分析200+文章,系统解析「鸡尾酒会问题」研究
清华等多校及字节跳动研究者全面调研语音分离领域,撰写综述论文,分析200余篇代表性论文。从问题定义、学习范式、模型架构等多维度展开,还探讨评估指标、数据集等,指出未来挑战与探索方向。
海外华人15人团队打造,统一理解与生成的图像模型,超越Nano banana登顶图像编辑
海外AI初创公司Luma发布图像生成模型Uni-1,将「理解」与「生成」统一,在多任务测试中表现优于GPT Image 1.5和Google Nano Banana Pro。它采用独特架构,提升理解能力,由华人团队打造。
告别单一大模型依赖!北航等机构发布综述:大语言模型集成(LLM Ensemble)
北航等机构发布的论文系统性回顾了LLM Ensemble领域进展,介绍分类法、相关问题、方法、基准、应用和未来方向。LLM Ensemble指推理阶段综合利用多模型优势,现有推理前、中、后三大集成范式。
Airbnb 的 Mussel V2:下一代的键值存储,以统一流和批处理
Airbnb工程团队推出Mussel v2,对内部键值引擎彻底重构,统一流和批处理,简化运维、扩展工作负载。它结合NewSQL后端与Kubernetes控制平面,解决了v1的局限,迁移虽有挑战但成功完成。
10% KV Cache实现无损数学推理!这个开源方法解决推理大模型「记忆过载」难题
推理大模型推理时易现冗余问题,R-KV开源方法登场,显存降90%、吞吐提6.6倍、准确率达100%。它通过实时对token排序解决冗余,还经多步骤压缩KV缓存,性能测试表现出色,适用多场景。
3个硬核 GitHub 项目,让 AI 帮你赚钱!
nof1.ai网站举办“AI量化交易擂台”,让GPT - 4、Claude、DeepSeek等模型用1万美元本金在加密货币市场自动交易。目前DeepSeek排名第一,11天收益率超90%。文章介绍3个相关GitHub项目,可让AI在金融市场竞技、分析交易。