全参数微调」共找到 2650 篇相关文章

算法论文8

上交大智能计算研究院论文:不只算对答案,大模型如何真正学会运筹建模丨ICLR 2026

上海交大智能计算研究院提出 StepORLM,通过生成式过程监督提升运筹建模可靠性。研究反思传统训练范式局限,在多数据集测试中,小参数的 StepORLM 表现超大型模型,还分析现有方法缺陷并提出解决框架,有重要方法论和应用意义。

AI科技评论
产品应用7

Unsloth让大模型跑在手机上!

Unsloth放出教程,可将其微调模型部署到Pixel 8和iPhone 15 Pro。用ExecuTorch技术优化,Qwen2 - 0.5B在旗舰机上表现流畅。教程介绍量化感知训练控制精度损失,还给出iOS和Android部署步骤及注意事项。

AI工程化
开源动态8

Yann LeCun放出憋了20年的大招:Meta开源V-JEPA 2世界模型

Meta发布V-JEPA 2世界模型,参数高达10亿,推理速度比英伟达Cosmos快30倍。它基于Vision Transformer架构,是Yann LeCun倡导多年的JEPA路线成果,仅需62小时机器人数据训练就能执行任务,打脸质疑者。

AGI Hunt
新闻资讯8

球第一AI科学家天团,首战封神!2.5个月找到治盲新药,医学圈震撼

世界首个AI科学家天团发布首个成果,2.5个月发现治疗失明新药。AI包办写论文过程,人类只需执行实验。团队推出自动化多智能体系统Robin,将开源代码,它可跨领域应用,标志科研新范式诞生。

新智元
推荐文章7

对话蚂蚁吴伟:训推一体池化调度,如何把GPU用到极限

AICon大会前,与蚂蚁集团吴伟深度对话,探讨GPU资源调度解法。他指出CPU和GPU有结构性差异,只在推理或训练内优化有资源闲置,国产卡缺链路生态,软件优化有天花板。还分享架构思路、算法及落地效果等。

InfoQ
产品应用8

史上首个被奥斯卡公开支持的AI,终于来了!Utopai模型又被刷屏了

AI原生影视工作室Utopai Studios年入1.1亿美元后又刷屏。其PAI模型可3分钟视频直出,获奥斯卡编剧Roger Avary公开站台,实测效果佳,还与哈登合作。Utopai走皮克斯链路管线路线,开启AI电影制作新时代。

新智元
推荐文章8

听了Andrej Karpathy最新2小时访谈,我对Agent彻底祛魅了

Andrej Karpathy在播客中表示,Agent发展还需十年,离像实习生工作还差很远,要解决诸多能力问题;他认为强化学习糟糕但其他方法更糟,还提出AI应削减背书式记忆、未来强大AI或仅十亿参数等观点。

MacTalk
开源动态8

机器人进入“边做边学”时代:星尘发布在线强化学习框架,让动态投掷成功率提升超141%

星尘智能基座模型团队公布在线强化学习框架SmoothRL,解决异步执行环境中具身模型在线微调难题。该框架让策略更新对应硬件实际执行,攻克延迟失准问题,在多项真机测试中大幅提升任务成功率。

AI前线
新闻资讯7

最大电动飞机首飞成功,飞行半小时电费5美元,这家初创想做航空业的特斯拉

8月12日,初创公司Heart Aerospace制造的最大电动飞机X1首飞成功,飞行约27分钟,电力消耗仅约5美元。公司想用电动飞机替代30 - 50座支线飞机,其后续发展受电池技术、成本等因素制约。

DeepTech深科技
推荐文章7

告别“氛围编程”:基于 Harness 治理和 SDD 的团队级 AI 研发范式演进与实践

本文作者王树新分享团队级AI研发范式演进与实践。指出AI Coding存在自由发挥、效率降低、关键信息丢失问题,分析出码率提升却未提效的原因,引入SDD与Harness解决问题,并介绍流程自动化实践。

阿里云开发者