「第二代AI预训练范式」共找到 11121 篇相关文章

开源动态8

告别“音画割裂”与“人物崩坏”!AutoMV:首个听懂歌词、卡准节拍的开源全曲级MV生成Agent

现有AI视频生成模型做全曲MV有时长限制、音画割裂和一致性差等问题。AutoMV作为开源多智能体系统,模拟人类影视制作流程,能生成长达数分钟、叙事连贯且音画同步的完整MV。

量子位
算法论文8

为什么这篇谷歌论文被称为「Attention is all you need」V2

谷歌新论文《嵌套学习:深度学习架构的幻象》引发关注,被称为「Attention is all you need」V2。它指出主流优化器是关联记忆系统,提出嵌套学习范式,构建HOPE架构,为AI设计带来新思考框架。

量子位
新闻资讯7

提示词一响,烂片登场,OpenAI谈下200+迪士尼顶级IP出场费

迪士尼官宣向OpenAI投资10亿美元,签三年合作协议,授权Sora用旗下200多个顶级IP生成短视频。此前好莱坞与AI版权纷争不断,如今迪士尼选择变现,但生成内容或影响其品牌形象。

机器之心
产品应用8

阿里“闪电战”再发力,这次是千问APP

阿里在AI领域影响力大,Qwen3-Max模型能力强,开源模型Qwen3-235B在Lmarena上开源第一。新发布的千问APP成Qwen模型第一入口,功能丰富免费,体验佳,是同类产品劲敌。

歸藏的AI工具箱
产品应用8

360发布全球最强视觉语言对齐模型!榜单全面领先!

360发布FG - CLIP 2双语细粒度视觉语言对齐模型,几乎在所有数据集上全面领先。它能让AI在统一框架内看懂图像细节、理解中英双语,团队还提出新中文多模态评测基准。

AIGC开放社区
算法论文8

AEPO:智能体熵平衡策略优化,让探索更稳,推理更深!

中国人民大学与快手团队联合提出 AEPO 算法,解决熵驱动式智能体强化学习训练不稳等问题。它设计两项核心机制,在 14 个基准上优于主流算法,在 X 等平台获高关注。

机器之心
推荐文章7

一文讲懂Agent及其主流框架:自己想、自己干、自己复盘的才是好Agent!

文章对比Workflow和Agent,指出复杂多变场景下Agent框架更适用。还介绍AutoGPT、LangGraph等5款主流Agent框架,涵盖其特点、应用场景等,最后提及腾讯云TDAI团队探索数据库与AI结合。

腾讯技术工程
新闻资讯8

Google封神,计算机视觉的GPT3时刻来了!

Google Deepmind称在CV领域做出类似GPT-3的成果,Veo 3经大规模训练涌现通用视觉理解和推理能力,能以图片+提示词完成复杂视觉任务,还具备感知、建模等四大超能力。

探索AGI
新闻资讯7

马斯克宣布用户将可语音定制X信息流

埃隆·马斯克宣布11月X平台算法将由AI驱动,开源代码会持续更新,用户能语音定制信息流。此计划引两极反应,算法也有缺陷,还面临可信度和信息茧房等问题。

AI工程化
新闻资讯7

对话逐际动力张巍:造机器人很容易,关键是用起来

量子位对话逐际动力创始人张巍,他表示人形机器人本体硬件制造容易,难点在大脑和小脑AI化能力。逐际动力要做技术平台,降低开发门槛,目标是让天下没有难落地的机器人。

量子位