全量微调」共找到 2611 篇相关文章

新闻资讯7

前后端一起消失:AI Coding正在改写大厂工程师分工

大厂研发组织出现调整,美团前后端团队合并,蚂蚁网商让测试岗转研发岗。AI Coding普及使技术岗位划分重塑,前后端边界成“栈能力”。AI编程工具虽有后端执行能力,但仍需资深工程师兜底。

InfoQ
开源动态8

解码加速15倍!EdgeRazor助推大模型在PC/移动端“狂飙”

大语言模型参数膨胀,端侧部署难,化成主流轻化方案。开源工具库EdgeRazor由南京大学和微软联合推出,采用MPQAD打破极低比特大语言模型“能力塌陷”,在性能、效率、易用性等方面表现出色,打通AI生态链路。

机器之心
新闻资讯8

当机器人学会「看」和「说」之后,如何让它们真正拥有「手感」?

今年四月,戴盟机器人联合多家机构发布含触觉模态具身数据集 Daimon-Infinity 并开源 10000 小时数据。IEEE 与戴盟联合创始人王煜教授深度对话,探讨触觉感知对机器人技术格局的影响、具身机器人落地场景等问题。

AI科技评论
产品应用7

浅析 Amazon S3 Files:工作机制、性能边界与选型思路

4月7日,AWS发布新服务Amazon S3 Files,可将S3存储桶作为高性能共享文件系统挂载到计算节点。本文分析其底层实现、工作机制、性能边界,与其他对象存储文件化方案对比,指出适用场景。

InfoQ
开源动态8

加速子计算到来!英伟达开源模型拉爆子计算股

英伟达发布并开源球首个加速子计算应用的模型系列Ising,打破硬件校准和纠错耗时难题,提供比传统方法更快、更准的子纠错解码能力,还推出校准基准测试,方位开源吸引众多机构加入。

AIGC开放社区
算法论文8

CVPR 2026 | 20步也能稳住画质,这个扩散加速方法不一样

扩散模型推理效率是落地应用的核心制约因素,阿里安 AGI 实验室 - 御风大模型团队联合浙江大学提出新扩散加速方法 TC - Padé,在低步数设置下能兼顾生成质与推理效率,已被 CVPR 2026 录用。

机器之心
算法论文8

POF | 上海理工大学梁梓浩、朱兵等:使用大语言模型进行气泡湍流实验数据处理

本文提出结合大语言模型(Time - LLM)与Transformer模型的复合框架处理气泡两相流热膜测信号干扰。先由Time - LLM识别气泡干扰信号,再用Transformer模型修复。实验证明该方法高效、轻且物理自洽。

力学与人工智能
推荐文章8

AI数据工程师在应用中如何"返璞归真"

文章反思‘知识库+Prompt工程+工具调用’轻级Agent构建模式局限,指出其难应对知识质、语义理解与规模化维护挑战。提出从‘Prompt驱动’到‘上下文工程’、从‘搭积木组装’到‘链路闭环’的范式跃迁,并介绍MktAI知识体系建设。

阿里云开发者
开源动态8

老黄入局吃龙虾!英伟达发布最强开源Agent推理模型

英伟达发布并开源120B参数的MoE模型Nemotron 3 Super,在多项测试中表现出色。它原生支持100万token上下文,吞吐大幅提升。英伟达还计划五年投260亿美元构建开源AI模型,开放参数权重等。

量子位
算法论文8

40倍推理加速!复旦&微软:用「非线性流」拟合复杂轨迹,2步生成媲美原画

ArcFlow是复旦与微软提出的图像生成加速方案,引入非线性流拟合复杂轨迹。它在仅2步推理下保持画质,实现约40倍推理加速和4倍训练收敛加速,微调极少参数,在多模型验证效果出色。

量子位