高质量论文」共找到 3104 篇相关文章

算法论文8

CVPR 2026 | ReFTA:打破张量化PEFT的「权重重建」瓶颈

随着大模型发展,全参数微调成本,参数效微调(PEFT)成主流。常见基于矩阵低秩分解的PEFT方法有局限,张量化PEFT虽有优势但存在权重重建问题。本文提出ReFTA方法解决该问题,有工程和理论优势。

机器之心
产品应用7

480P的元宇宙入口:Midjourney不是在做视频,是在造"任意门"

Midjourney发布首个视频模型Video V1,它只能图生视频,操作便捷。虽分辨率仅480P,但采样率。生成成本低,会员就能用。其美学表现好、生成速度快,不过在提示词理解等方面较弱。该公司有独特愿景。

歸藏的AI工具箱
新闻资讯7

成立 5 年最估值超百亿,摩尔线程之后,又一家AI芯片独角兽争当“国产 GPU 第一股”

6月23日,沐曦集成电路IPO辅导完成,离A股上市更近一步。它成立于2020年,专注性能GPU,产品应用广,还与书生・浦语3.0合作。虽曾被曝裁员,但已完成8轮融资。当下国产GPU厂商扎堆IPO,适配DeepSeek或带来机遇。

AI前线
算法论文8

超越对数似然:模型能力连续体下的监督微调新范式

论文挑战监督微调(SFT)用负对数似然(NLL)作训练目标的默认设定,提出基于概率的目标家族,引入“模型能力连续体”概念,分析不同目标在不同模型能力下的表现,为模型后训练提供新优化方向。

深度学习自然语言处理
新闻资讯7

墙体的AI革命!智能超表面如何让建筑「听懂」6G信号?

在5G基站功耗、室内信号衰减成瓶颈的当下,文章探讨6G如何借智能超表面和建筑无线友好性优化室内流量。还分析建筑设计对信号的影响,以及人类移动行为给超表面嵌入建筑信道带来的挑战。

新智元
开源动态8

英伟达开源9B参数小模型,比Qwen3快6倍

英伟达推出新型小型语言模型Nemotron Nano v2,在复杂推理基准测试上准确率与Qwen3 - 8B相当或更,速度快6倍。它兼顾推理与非推理任务,支持“思考”预算控制,还开源了创建模型的绝大部分数据。

量子位
算法论文8

北大2篇Skill炸场,Agent彻底进化

北京大学连发两篇论文,给出让 Agent 变强的答案:让 Skill 自己进化。`SESA` 针对工具增强的搜索问答,用四个阶段闭环使任务生成和技能记忆一起进化;`VeriSkill` 把验证器废信号变成可信更新,二者场景不同但核心一致。

PaperAgent
产品应用8

接入 MiniMax M2.7 后,我的 OpenClaw「超进化」了

作者实测 MiniMax 新模型 M2.7,其在基准测试、代码能力、多智能体协作等方面表现出色。接入 OpenClaw 后,能效完成复杂任务。M2.7 指令遵循率、长上下文处理能力强且价格低,有望提升 Agent 生态表现。

特工宇宙
算法论文8

像开发软件一样造世界,Agent2World来了,把世界模型做成可运行的符号环境

为让模型真正“能行动”,需可执行、可验证的符号世界模型,但现有自动生成路线有困局。研究团队提出 Agent2World,经实验验证有显著效果,能稳定产出质量符号世界模型,开辟 AI 理解现实环境新可能。

机器之心
推荐文章8

吴恩达年终总结:2025是AI工业时代的黎明

吴恩达发表2025人工智能年度总结与公开信。总结指出,今年推理模型性能提升但有成本,AI人才争夺激烈、薪酬,数据中心建设投入大,智能体让编程更效。信中建议通过学课程、动手实践和读论文构建AI系统。

机器之心