山中因子」共找到 2627 篇相关文章

算法论文7

R1/Qwen训练新范式:无需继续训练,直接“算”出权重,提效500%

DeepSeek - R1爆火让RLVR成大模型后训练焦点,但训练代价高昂。学者发现RLVRLLM权重和输出概率呈线性变化,提出“权重外推”等方法,实现最高6.1倍训练加速,RL - Extra在多榜单展现高效率。

PaperAgent
算法论文8

港大×复旦×上交:视触觉融合+闭环纠错,让机器人双臂协作不再「盲操」

港大联合复旦、上交大提出TAMEn,在UMI框架上全方位升级,构建视触感知融合等数据闭环,打通数据采集到再训练链路。其三层闭环让机器人学得更快准高效,在双臂协作任务提升成功率。

量子位
开源动态8

告别大模型“失忆”!人大开源MemSifter:轻量代理先思考再回忆,搞定长时记忆

国人民大学团队提出全新LLM记忆管理框架MemSifter,打破长时记忆管理‘精度不够’和‘成本太高’的困局。它将记忆检索‘外包’给轻量级代理模型,采用任务结果导向的RL训练范式,在8个基准测试超越现有SOTA方案。

深度学习自然语言处理
新闻资讯7

养虾人狂吃国产模型!4.19万亿Token调用量激增34.9%超越美国

根据OpenRouter数据,上周国大模型周调用总量飙升至4.19万亿Token,再度超越美国登顶全球。国产品在全球大模型调用量Top 5占三席,国产大模型受青睐,但在速度和价格方面仍待提升。

量子位
新闻资讯8

长生不老成真?哈佛AI数周破解「衰老密码」,人类寿命或迎重写

哈佛团队借助AI系统K-Dense揭示衰老分阶段运行的秘密。K-Dense采用层级多代理架构,能完整跑通研究流程,在BixBench测试超越GPT - 5。它还让哈佛团队几周完成原本数年的研究,成果待同行评审。

新智元
开源动态7

Rex-Omni:用 3B 模型颠覆目标检测

长期目标检测依赖传统坐标回归模型,MLLMs方法存在不足。IDEA研究院提出30亿参数的Rex - Omni多模态大模型,在零样本测试表现超现有回归模型,还具备丰富语言理解能力,有独特设计和训练流程。

带你学AI
算法论文8

首创像素空间推理,7B模型领先GPT-4o,让VLM能像人类一样「眼脑并用」

当前主流视觉语言模型(VLM)依赖文本token间接翻译视觉信息,缺乏直接视觉操作能力。滑铁卢大学等团队提出「像素空间推理」范式,让VLM能像人类一样「眼脑并用」,在四大视觉推理基准测试,7B的Pixel - Reasoner表现碾压GPT - 4o等。

量子位
新闻资讯7

刚刚!Claude Fable 5,又拿第一了

在刚刚刷新的MirrorCode排行榜上,Claude Fable 5以64%的绝对成功率登顶,成绩远超其他模型。它在不同语言上表现稳定,在稀缺语言也只小幅度下降。这意味着前沿模型能独立完成部分大型软件。

新智元
算法论文7

又一推理新范式:将LLM自身视作「改进操作符」,突破长思维链极限

Meta等机构研究者将LLM视为「思维」改进操作符,探究并行 - 蒸馏 - 精炼(PDR)推理方法。实验显示,PDR在数学任务提升准确率,还训练8B模型让推理方法更适配,减少训练与部署的不匹配。

机器之心
产品应用7

刚刚,谷歌放出Nano Banana六大正宗Prompt玩法,手残党速来

谷歌 Nano Banana 被网友玩出花样,背后是巧妙提示词的功劳。刚刚谷歌官方公布了该模型六个文本转图像提示,可进行文本生成图像等操作,还给出对应提示模板,不过使用也存在一些问题。

机器之心