开源动效引擎」共找到 3340 篇相关文章

产品应用7

FairyGen:AI 把孩子的画“”起来,个性化教育和画创作

FairyGen 能将孩子画作变成卡通短片,通过多模态大语言模型构思分镜脚本,采用分层建模处理前景人物作与背景态。其生成流程分四阶段,但也存在前景角色重建不准、背景生成不稳定等问题。

带你学AI
开源动态8

紫东太初开源视觉神经增强方法,即插即用终结多模态幻觉 | ACL 2025

中科院自化所等团队提出VHR方案,通过“视觉神经增强”机制放大模型视觉关键注意力头输出,降低幻觉现象。此前主流方法多作用于最终输出阶段,VHR深入干预内部机制,还介绍了SSL语义引导方法。

量子位
开源动态7

12.6k,谷歌这个开源项目炸了,全栈AI Agent

谷歌开源的Gemini Fullstack LangGraph Quickstart项目两周冲到12.6k star。它是使用React前端和LangGraph驱后端Agent的全栈应用程序,能对用户查询做全面研究,有多项特征及明确的后端工作步骤。

PaperAgent
算法论文8

给大模型装上「思维分段引擎」:浙大InftyThink解锁无限深度推理

如今大模型长上下文推理面临计算成本高、推理易中断问题。浙大联合北大团队提出InftyThink新范式,将传统推理拆成短片段并总结,突破推理长度限制,在多基座模型实验中表现优异。

量子位
开源动态8

狂涨 9.1K star!最近这款谷歌的AI开源应用,超级火!

介绍Google的实验性应用`Google AI Edge Gallery`,它将生成式AI模型嵌入手机,支持Android和iOS,可离线运行,有多种实用功能,在Github获9.1K star,虽处Alpha阶段但潜力大。

开源先锋
产品应用7

ChatGPT这次对数学教育了真格,家长学生都不用愁了

OpenAI针对数学和科学学科抽象难学问题,推出ChatGPT态可视化交互解释新功能,从超70个核心概念起步,可让用户拖变量、调整公式,实时观察结果变化,今日面向全球已登录用户开放。

AI寒武纪
开源动态7

谢赛宁也玩MC?开源全新世界模型生成多人一致的游戏视角

电子游戏推AI发展,谢赛宁团队探索世界模型新方向,推出多人视频世界模型Solaris。该模型能生成多人一致的第一视角,团队还搭建了多人数据采集系统SolarisEngine,构建了多人Minecraft数据集。实验结果显示,其方法在多方面表现更优。

机器之心
产品应用8

小鹏加速冲向L4终局:对VLA架构「刀」成关键一环

在辅助驾驶领域,端到端的VLA方法虽有效果,但面临中间层语言难以准确表达物理世界细节的问题。小鹏汽车去掉“语言转译”环节,推出第二代VLA,有跨代级驾驶体验,背后是底层技术架构重构。

机器之心
开源动态8

世界模型+强化学习=具身智能性能翻倍!清华&加州伯克利最新开源

具身智能发展中样本效率成瓶颈,传统无模型强化学习依赖盲目试错。清华与加州伯克利团队提出BOOM框架,通过自举循环机制解决在线规划与策略学习矛盾,实验表现卓越,为具身智能落地提供支撑。

量子位
开源动态8

小米陈龙团队首作:统一具身与自驾驶的开源模型

小米具身智能团队发布首篇论文,提出统一具身智能与自驾驶的新模型MiMo-Embodied。该模型在多任务中领先,其四阶段训练框架打通两领域边界,为行业提供新范式。

AI科技评论