LoRA训练方法」共找到 3301 篇相关文章

开源动态8

Agent的自演进,被刚刚开源的AReaL 2.0按下了加速键

Agent 正从「会使用工具并完成任务」向「在使用中学习并改进方法」转变,但面临自演进难题。AReaL 2.0 上线,解决 Agent 服务侧问题,给出在线学习闭环方案,其价值已在实践中得到验证。

机器之心
算法论文8

如何判断AI视频真假?综述动态、可溯源、可解释的检测体系 | ACL26

AI视频生成技术发展快,现有检测方法难满足需求。新综述提出‘事实保真度验证’目标,梳理四层检测框架,涵盖底层线索、时空一致性等,强调多层证据耦合与可解释性,还分析评测指标与数据集。

新智元
开源动态8

英伟达MoE新开源:一行import,微调加速3.7倍

英伟达开源NeMo AutoModel,基于Hugging Face Transformers v5,不改代码API,添一行import就能更快速微调MoE模型。实验显示,它能提升3.4 - 3.7倍训练吞吐,减少29% - 32% GPU显存占用。

量子位
产品应用7

Kimi Work 推出目标模式:连肝 24 小时做了本漫画书,已开源

Kimi Work 推出目标模式,设定完成条件可自动工作至达标。与 Claude Code、Codex 有差异,还具 Agent 集群能力。作者用其复刻 Logo、转换论文格式、制作漫画书并开源,指出目标模式类似模型训练

AGI Hunt
算法论文8

蚂蚁EGSS算法破解Test Time Scaling困局 | ACL 2026

蚂蚁集团CodeFuse团队在ACL 2026主会论文中提出EGSS算法,破解Test Time Scaling困局。该算法精准识别高不确定性决策点,解决计算冗余与选择脆弱问题,在SWE - Bench - Verified上全模型提升5 - 10%。

量子位
算法论文8

ICML 2026 | 大模型为什么算不对加法?南大团队提出等本位和轨迹,揭示LLM算术错误的几何机制

南大团队研究LLM在多操作数加法中的内部表征结构,发现算术状态呈高度结构化几何流形。提出等本位和轨迹与噪声量化模型,解释模型算错加法原因,还设计推理时纠错方法

机器之心
算法论文8

Karpathy加入Anthropic要做的事,被Google提前做了

Karpathy官宣加入Anthropic要组建新团队‘用Claude加速预训练研究’,话音未落,Google&Meta等发论文‘LLMs Improving LLMs’验证了该思路。论文让Claude Code搜索最优推理策略,结果全面超越人类设计。

PaperAgent
产品应用7

分享一个 Skill:如何找到值得做的创业 idea

作者分享找创业想法的方法,认为AI时代想法重要性回归。介绍通过AI获取各平台信号,还推荐Tabbit浏览器,其能创建复用妙招扫描机会,给出结构化清单,还可定时执行,有共享社区。

AGI Hunt
产品应用7

用 Codex 拯救我的 Mac

作者从2008年开始用Mac办公研发,历经系统更迭未重装。现因系统更新,不少程序是Intel版,用Rosetta 2转接,很混乱。介绍用Codex清理开发环境、更换M芯片版本Homebrew的方法

MacTalk
开源动态8

几张GPU干翻超算!耶鲁AI颠覆化学合成,实验成功率71%

近日,耶鲁大学李昊特团队开发 AI 系统 MOSAIC,将化学合成知识分 2498 个领域训练专家模型。测试中对超 35 种新化合物合成成功率达 71%,还完成难反应与新反应,相关论文发表于《自然》。

DeepTech深科技