「量化框架」共找到 1810 篇相关文章
成功率最高暴跌36.9%!南洋理工首个“模糊指令”测试,直击具身智能落地软肋
南洋理工大学MARS Lab团队联合发布测试基准REI-Bench,量化现有具身智能大模型缺陷。在其测试下,主流任务成功率最高降36.9%。研究还剖析错误原因,给出解法,望引起学界重视。
ACL 2026 | 中科大&上海AILab揭示强化学习后训练的Scaling Law
中国科学技术大学和上海人工智能实验室等团队,在Qwen2.5和Llama 3模型开展研究,揭示强化学习后训练的Scaling Law,提出幂律公式预测模型学习效率与训练轨迹,成果被ACL 2026接收。
将庞大3D世界装进手机!李飞飞Spark 2.0开源
李飞飞团队开源核心技术Spark 2.0,可优化3D世界,让普通设备通过浏览器流畅访问交互。它有自动选细节、分批加载、优化存储三绝招,适配主流框架,有望改变与数字世界互动方式。
彻底封杀!Anthropic第四刀砍向龙虾,开发者哀嚎,两大创始人互喷!
前天Anthropic封杀OpenClaw订阅额度后,24小时内又在官方轻量化命令行工具查人,提示词含“OpenClaw”就返回400错误。两大负责人隔空交火,开发者各寻出路,这或成Anthropic战略失误。
ICLR 2026 Oral | Revela:用语言建模重新定义稠密检索器训练
在检索增强生成系统中,稠密检索器是核心组件,但传统训练方法有局限。德国达姆施塔特工业大学蔡丰宇团队提出Revela,将检索器训练目标统一到语言建模框架,优势明显,实验效果佳。
告别AI「鬼画符」!一行指令「复活」王羲之、苏轼,带连笔、懂排版,项目已开源丨ICLR'26
UniCalli由香港科技大学(广州)等团队推出,是全新统一扩散框架,能精准生成书法排版和连笔,将书法生成和古籍识别统一,工作被ICLR2026接收,代码、数据集开源,还有在线Demo。
突然猛涨7K+ star!阿里开源的前端增强项目火了!
阿里开源的前端增强项目 PageAgent 火了,在 GitHub 获 8k+ star。它是纯前端 JavaScript GUI 智能体框架,可让网页拥有 AI Agent,通过自然语言控制界面,有自动填表单等功能,使用简单。
清华刘知远团队论文:最小化结构改动,短文本到长文本丝滑升级 | ICLR 2026
大语言模型发展中,上下文长度成关键瓶颈,主流架构计算开销大。清华刘知远团队提出《InfLLM-V2: Dense-Sparse Switchable Attention for Seamless Short-to-Long Adaptation》,提出可切换注意力框架,为长上下文研究提供新思路。
自建一个 Agent 很难吗?一语道破,万语难明
作者分享给传统研发平台接入 Agent 开发能力的经验,介绍技术选型、方案落地、系统提示词优化、知识库建设等内容,还提及工具接入、上下文管理等方面,为想自建 Agent 的人提供启发。
MIT天才博士刚毕业,就被前OpenAI CTO抢走!年薪或300万起步
MIT天才博士肖光烜刚毕业就官宣加盟Thinking Machines,主攻大模型预训练。他履历耀眼,博士论文破解LLM三大难题,构建高效大模型框架。Thinking Machines薪资可观,平均年薪超OpenAI等公司。