「视频扩散技术」共找到 3765 篇相关文章
大模型微调知识与实践分享
文章详细介绍大型语言模型(LLM)微调知识与实践,包括模型结构、参数量等知识,以及Prompt工程、数据构造、LoRA微调等技术点。还给出微调实践流程,介绍相关平台和框架,如星云、TuningFactory等。
Science重磅:AI编程新手与资深开发者之间的差距巨大
《科学》杂志发表的AI编程全球调查研究显示,美国程序员提交的Python代码中29%由AI代笔,资深开发者借此拉大与新手差距。研究团队用GraphCodeBert模型分类器扫描代码,揭示技术扩散差异与隐忧。
英伟达XR-AI Scientist亮相:丛乐、王梦迪团队把“AI科学家”送进实验室|甲子光年
10月底英伟达上线NVIDIA XR - AI平台,丛乐、王梦迪团队联合英伟达等推进其在实验室科学融合应用,涉及LabOS和CRISPR - GPT两项技术突破,还推出LSV Benchmark标准及排行榜,有望改变XR现状。
天下苦VAE久矣:阿里高德提出像素空间生成模型训练范式, 彻底告别VAE依赖
当前主流图像生成技术训练范式依赖VAE,带来训练复杂、微调成本高的问题。阿里高德提出EPG,结合自监督预训练与端到端微调,去除对VAE依赖,在训练效率和生成效果上有突破。
Anthropic 发布 AI Agent 上下文工程指南
今年6月Andrej Karpathy提出用「上下文工程」取代「提示词工程」。Anthropic发布工程博客呼应此观点,指出构建AI应用重心转向策划上下文。文章详述上下文工程重要性、有效上下文剖析、检索及长时任务应对技术等。
对谈 Memories AI 创始人 Shawn: 给 AI 做一套“视觉海马体”|Best Minds
本文是对 Memories AI 创始人 Shawn 的访谈。他指出当下 AI 记忆多为“上下文工程”,其团队致力于打造视觉记忆层 LVMM。还探讨了视觉与文本记忆区别、LVMM 架构及应用场景等,认为视觉记忆将成下一代 AI 核心。
独家|「中科第五纪」完成数亿元A轮融资,率先开启海外商业落地
AI科技评论独家消息,具身智能企业「中科第五纪」近日完成数亿元A轮融资,年内已完成三轮。该公司还收获海外数亿订单。其提出超少样本具身操作大模型等核心技术,形成完整技术体系。
战火升级!奥特曼正式杀入脑机接口,这次不用切脑
近日,奥特曼邀专家加入脑机接口创业公司Merge Labs,计划以8.5亿美元估值融资。它将采用非侵入式技术,与马斯克Neuralink的开颅手术竞争,奥特曼曾投资Neuralink但不认同其侵入式做法。
用户集体大逃亡!Cursor“自杀式政策”致口碑崩塌:“补贴”换来的王座,正被反噬撕碎
很多开发者吐槽并弃用 Cursor,因其付费后砍功能、技术变差、营销像‘障眼法’,引发信任危机。部分用户转向 Claude Code,不过企业侧使用情况有差异。AI 编程工具竞争激烈,需多维度构建优势,市场未来趋势明显。
AI深度应用关键元年,快手重塑内容与商业价值
2025年是AI深度应用元年,AI走向产业级价值兑现。快手在1024程序员节展示AI与业务融合布局。程一笑称竞争关键是结合AI与场景,快手构建技术与应用栈,各业务成果显著,推动全链路AI重塑。