超树建模」共找到 2331 篇相关文章

算法论文8

从打分器到思考者:RM-R1用推理重塑模型价值判断

伊利诺伊大学香槟分校团队提出 RM - R1 框架,将奖励建模定义为推理任务。它引入推理奖励模型和链式评估准则机制,经两阶段训练,在多基准测试中表现大规模模型,验证了推理能力对奖励模型的重要性。

机器之心
推荐文章7

6个做AI和ML的奇技淫巧

作者整理了6个做AI和ML的技巧,如提前结束评估、参数过度优化、精心挑选数据集等,指出现在90%的模型可能都用到其中不止一招,还介绍了自己用AI采集资讯发布到知识星球。

AGI Hunt
产品应用7

Cursor发布Composer 2:专攻代码的模型,价格只有GPT-5的零头

Cursor本周发布自研编程模型Composer 2,只攻代码生成。其得分提升,Claude Opus 4.6,接近GPT - 5.4 Thinking。训练基于代码数据,处理复杂编程任务准确度高,价格远低于竞品。这是Cursor全栈布局,欲掌握AI编程主动权。

AI工程化
开源动态8

王兴一鸣惊人!美团首个开源大模型追平DeepSeek-V3.1

美团首个开源大模型Longcat-Flash-Chat发布即引发热议。它在部分benchmark上DeepSeek-V3.1等,编程能力也出色。技术报告透露美团对大模型的理解,还有新发现,且性能好、训练效率高。

量子位
算法论文7

生成式推理再排序,可能会是LLM4RecSys的新突破口吗?

Meta AI研究者尝试把推理模型引入推荐系统再排序阶段。论文通过监督微调等赋予模型推理能力,LLM4Recsys标杆。中期内化物品语意ID,生成推理路径,推理赋能再排序,披露重排序提升空间。

机器之心
开源动态8

一周10来个模型被开源,阿里Qwen杀疯了~

阿里通义千问这周开源众多模型,如Qwen3 - Omni、Qwen - Image - Edit等,涉及全模态、图像编辑、安全审核等多领域。各模型能力出色,如Qwen3 - Omni能处理多模态输入,Qwen3 - VL表现部分闭源模型。

PaperAgent
新闻资讯8

2025临界点:AI智商越人类,经济规则即将改写

AI平均智商110,2025年将参与经济全链条操作。AI经济浮现,具备全天候自动运行、无劳动力供给限制、或成非稀缺经济等特点,还能降低交易成本、减少非理性决策,或带来人类第三次理性化浪潮。

新智元
新闻资讯7

中科闻歌完成新一轮战略融资,引领企业级人工智能技术发展

近日,中科闻歌完成新一轮战略融资,投资方为石景山区产业基金。融资用于自研决策智能操作系统DIOS研发与推广。中科闻歌技术实力强,有全栈自研体系,已服务千家客户,后续将深耕多领域并拓展海外市场。

量子位
算法论文8

直接从像素到单词:这个原生大模型统一单图、多图、视频和空间智能

南洋理工大学等团队推出NEO - ov模型,挑战传统「视觉编码器 + 大模型」范式,直接从原始像素学语言。它在多任务表现出色,尤其空间智能突出,但在OCR等方面有短板,展现原生多模态建模潜力。

机器之心
新闻资讯7

Cursor押注云端Agent!CEO 放话:审核AI代码是开发者最核心竞争力

Cursor CEO 称 AI 编程进入第三时代,智能体可少人工介入完成复杂任务,开发者角色转变。Cursor 团队三分之一 PR 由云端智能体生成,不过这引发了开发者对代码审查、工作流、安全等问题的讨论。

InfoQ