全模态生成式推荐」共找到 2644 篇相关文章

新闻资讯8

官宣!前 OpenAI 华人科学家姚顺雨加入腾讯,大模型“系统战”开启!

12月17日消息,前OpenAI科学家姚顺雨加盟腾讯,任首席AI科学家等职。他是AI Agent与大模型推理领军人物,其加入是腾讯AI补强。腾讯还新成立三部门,标志战略向系统化工程建设进阶,混元也有不错表现。

AI科技大本营
算法论文8

303页年度最佳AI Code综述:阿里、字节、快手30家顶级机构出品

分享303页《从代码基础模型到智能体与应用:代码智能实践指南》,由近30家顶尖机构出品。介绍2021 - 2025年代码大型语言模型发展,分析通用与代码专用LLM能力,阐明研究 - 实践差距,还开展实验。

PaperAgent
算法论文8

视觉思维链全新架构,加州大学让多模态大模型有了灵性,整体性能提升5.3%

加州大学伯克利分校等团队提出视觉思维链(CoVT)架构,让视觉语言模型推理时生成连续视觉信号。它内化轻量级专家能力,采用对齐策略和四阶段训练,实验显示性能提升,还具可解释性。

AIGC开放社区
开源动态7

新玩法!Karpathy周末手搓“大模型智囊团”应用:各大LLM同台互评,代码已开源

Andrej Karpathy周末手搓Web应用llm - council,让多个大模型像顾问般提供建议。查询通过OpenRouter分发给多个大模型,它们互评后由‘大模型主席’生成最终回复,代码已开源。

AI寒武纪
新闻资讯8

李飞飞最新长文:AI的下一个十年——构建真正具备空间智能的机器

李飞飞发表长文《From Words to Worlds: Spatial Intelligence is AI’s Next Frontier》,解读空间智能,阐述构建具备空间智能机器的核心框架,探讨其应用场景,认为这是AI下一个前沿。

机器之心
算法论文8

Thinking with Video:一种全新的思考范式

在人工智能领域,‘用文本思考’和‘用图像思考’存在局限。复旦大学等团队提出‘用视频思考’范式,通过视频生成模型统一文本与视觉推理,构建VideoThinkBench基准测试Sora - 2,全面解读这一开创性工作。

深度学习自然语言处理
新闻资讯7

刚刚,英伟达拟10亿美元砸向这家AI编码创企!Copilot 技术大佬带队、成立两年估值近千亿

10月30日消息,英伟达拟向AI初创公司Poolside投资最高10亿美元。该公司由微软技术大佬带队,定位生成式AI与软件开发交叉领域,开发自研模型,有独特强化学习方法和技术布局。

InfoQ
算法论文8

自适应Agent基础模型:从“会推理/会用工具”到“懂得取舍的执行者”

当前大型语言模型在智能体/工具调用场景有推理型和工具型两类,存在效率与功能、深度的矛盾。A²FM框架提出多模式自适应路由,实现模式自适应切换,在多基准测试中效果与效率双升。

深度学习自然语言处理
开源动态7

国产开源LLM大爆发,Qwen、Minimax、美团、腾讯~

近期国产开源LLM大爆发,Qwen3-VL家族新增模型,有技术亮点且可免费商用;MiniMax-M2为编码和代理任务打造;美团LongCat-Video、LongCat-Audio-Codec各有专长;腾讯混元世界 - 镜像用于3D几何预测。

PaperAgent
新闻资讯8

AI时代,开发者不能再当 i 人了,「云计算代言人」敬告

亚马逊云科技副总裁 Jeff Barr 时隔 16 年再访中国,对比两个技术时代。他认为 AI 带来创新与挑战,开发者需强大沟通力。还介绍亚马逊云科技工具 Kiro 及新开发模式,预测未来软件开发形态转变。

机器之心