和差集」共找到 7385 篇相关文章

算法论文7

Talking-Critic奖励模型带来更自然的音频驱动肖像

近期音频驱动肖像动画技术发展快,但现有方法存在嘴型声音不对、动作不自然等问题。阿里提出Talking - Critic奖励模型,构建Talking - NSQ数据,还提出TLPO优化框架,提升多维度表现,实验超现有SOTA方法。

带你学AI
开源动态8

如何科学地“设计”SFT 数据?一次关于 ODA 的完整平台级验证

大模型后训练阶段,SFT数据构建常依赖‘直觉’或‘试错’。上海人工智能实验室OpenDataLab团队发布报告,基于OpenDataArena提出新范式,将数据构建从‘随机艺术’变为‘确定性工程’,并进行平台级验证。

深度学习自然语言处理
新闻资讯7

英伟达机器人掌门人Jim Fan年度复盘:Vibe Coding火出圈,机器人领域却依然焦头烂额

AK推文让Vibe Coding火出圈,而英伟达机器人负责人Jim Fan对2025机器人领域发展泼冷水,指出硬件可靠性、Benchmark混乱、VLA路线存问题等现状,并分享3个教训,还回应网友质疑。

AI寒武纪
推荐文章7

人类程序员依然远强于LLM:为什么说 AI 目前还点火候

Redis之父Antirez的博文指出人类程序员远强于LLM。他修复Redis向量缺陷时,与Gemini 2.5 PRO交流,虽其有帮助,但人类跳出固有思维解决问题的创造力是LLM难以企及的。

AI寒武纪
推荐文章7

技多不压身,那龙虾的 Skill 是越多越好吗?

作者结合学术研究自身经验探讨小龙虾装Skill问题。研究表明Skill并非越多越好,装多效果变,还给出合适数量区间。同时分享用好Skill的经验,如按需安装、合理增减拆分等。

特工宇宙
算法论文8

SIGGRAPH Asia 2025|30FPS普通相机恢复200FPS细节,4D重建方案来了

3D视觉领域难题是用普通摄像机将高速世界转为数字化4D时空。受限于成本带宽,现有方法有局限。本文提出“异步采 + 视频扩散模型修复”方案,用30 FPS相机恢复100 - 200 FPS动态细节。

机器之心
算法论文8

单卡即可微调大模型!内存占用仅1/8,性能依然拉满 | ICML 2025

基础大模型应用于下游任务时微调成本高,低秩适应(LoRA)方法虽降低成本,但性能不及全量微调。华中科技大学香港中文大学团队提出GOAT框架,在25个多领域任务验证效果好,内存占用仅1/8。

量子位
开源动态8

Transformer论文作者重造龙虾,Rust搓出钢铁版,告别OpenClaw裸奔漏洞

Transformer作者Illia Polosukhin重造安全版龙虾IronClaw。OpenClaw安全状况,IronClaw用Rust重写,建立四层防御,还能防提示注入。其背后是NEAR更大构想,目标是用户掌控数据资产。

量子位
推荐文章7

《动手写AI Agent》流式输出:别让用户干等着

文章围绕《动手写AI Agent》流式输出展开,指出此前Ling使用体验,因无流式输出,用户等待久。介绍主流LLM流式接口基于SSE,对比OpenAI、火山引擎与Claude格式异,并定义统一的StreamChunk类型。

AI Reading Hub
算法论文8

人类画了100年的脑图,AI仅用几小时!还绘制出新脑区

加州大学旧金山分校团队提出CellTransformer算法,几小时完成5只小鼠脑图谱绘制,还绘出新脑区。该算法能准确对齐已知脑区,可扩展到多动物数据,未来有望用于人类大脑及其他器官研究。

量子位