4D视频生成框架」共找到 3887 篇相关文章

产品应用7

The Batch: 978 | DeepSeek-V4-Pro 更新了

DeepSeek发布旗舰模型DeepSeek-V4-Pro-0813正式版,性能提升,还发布开源agent harness开发者预览版并提价。模型在多指标表现佳,编码能力改进明显,公司公开基准测试框架意义大。

DeeplearningAI
算法论文8

让大模型自己写代码、自己进化,GIM和港大这篇ACL主会,把量化因子挖掘重做了一遍

香港大学和GIM提出CogAlpha框架,将Alpha从‘公式’升级为‘代码’,搭建7层21个智能体探索体系,让大模型参与研究流程。在5个数据集上跑赢21个基线方法,还具可解释性。

机器之心
新闻资讯8

再见,程序员!硅谷全员AI Coding,卡帕西宣告9级地震来了

2025年12月27日,Andrej Karpathy推文指出软件工程职业正被重塑,引发开发者恐慌。知名博主Theo称该领域已到永久性拐点,现在70% - 90%代码由AI生成,程序员角色将重构,还给出应对指南。

新智元
算法论文8

上科大何旭明团队新作:克服简单样本偏置,让多模态模型学会「难题优先」

上海科技大学何旭明团队针对多模态模型幻觉问题,提出DA-DPO框架。该方法不依赖额外人工标注,通过动态调整样本权重,缓解简单样本偏置,在降低幻觉率同时提升综合能力,具成本效益。

AI科技评论
新闻资讯8

中科院首提「AI哲学」,万字解读:为自身立命,为AI立心

中科院吴怀宇教授首次系统性提出「AI哲学」体系,以「感智境行」为核心架构,探讨智能本质、人机边界等,为人类应对AI冲击提供认知框架,也为AI赋予意识根基,涉及多学科,具多方面价值。

新智元
算法论文8

让VLM学会「心中有世界」:VAGEN用多轮RL把视觉智能变成「世界模型」推理机器

当前VLM智能体面对复杂视觉任务表现不佳,美国西北大学等机构联合研究成果VAGEN,提出创新强化学习框架,奖励正确思考过程,让VLM在行动前构建内部世界模型,效果超多款闭源大模型。

机器之心
算法论文8

ICLR神秘论文曝光!SAM3用「概念」看世界,重构视觉AI新范式

2023年Meta推出SAM,后SAM 2扩展到视频分割。近日,SAM 3现身ICLR 2026盲审论文,带来「基于概念的分割」新范式,强调按「语义概念」理解和分割图像,还构建数据引擎提升性能。

新智元
产品应用8

实测谷歌AI故事书,我实现漫画和绘本自由了

谷歌Gemini推出免费StoryBook工具,30秒左右可生成10页故事书,支持中文且内容有趣。测试显示,它在图像风格、故事创作上表现出色,还能作学习和展示工具,获网友好评。

量子位
算法论文8

AI「偷学」你的数据?6大顶级机构联手提出数据保护4大分级体系

生成式AI普及,数据保护成挑战。来自多机构研究者发布论文,提出全新数据保护分级体系,分为数据不可用、隐私保护、可溯源、可删除四级,还探讨了技术、法规及面临的挑战。

机器之心
算法论文8

何恺明等降维打击!彻底颠覆AI生图,无需预训练一步到位

何恺明团队推出生成模型MeanFlow,它跳脱传统训练范式,无需预训练等,仅一次函数评估就能完成生成。在ImageNet 256×256上表现优越,缩小了一步与多步模型性能差距。

新智元