「大模型智能体」共找到 10801 篇相关文章

算法论文8

单向VLM变双向!人大斯坦福等提出MoCa框架:双向多模态编码器

人大、斯坦福等机构提出MoCa框架,将单向视觉语言模型转化为双向多模态嵌入模型。它通过持续预训练和异构对比微调,解决传统模型局限,在多模态基准测试中表现优异,尤其小规模模型性能突出。

新智元
新闻资讯8

“我不会被 AI 吞噬”!菲尔兹奖得主、scikit-learn 守护者与全球顶尖 AI 专家巴黎共话 AI Vision | GOSIM Paris 2026

2026年5月4日,GOSIM Paris 2026 AI Vision Forum在巴黎举行。菲尔兹奖得主、scikit - learn守护者等全球顶尖AI专家共话AI。全天议程涵盖智能体AI系统、AI教育应用等四大核心议题,强调面对AI浪潮,开放才能让人类居核心。

AI科技大本营
算法论文8

学会“吃一堑长一智",性能飙升11%!XSKILL让AI积累经验和技能

XSKILL框架让AI像人一样积累经验和技能,将任务级技能与动作级经验统一到双流设计中,通过视觉接地提取和检索知识,在多个基准测试中显著提升性能,还展现出跨模型迁移性。

AIGC开放社区
算法论文8

突破万次连续编辑极限!中科院提出首个理论保稳的知识保留方法

中科院信工所研究人员提出LyapLock,将连续编辑建模为受约束随机规划问题,整合排队论和李雅普诺夫优化。实验显示,它能突破万次连续编辑极限,编辑效果比主流方法提升11.89%,还可赋能现有模型。

新智元
产品应用9

实测 Seedance 2.5 vs 可灵 3.0,谁能让我们无痛当上视频导演?

本文通过两大真实创作测试场景,对比Seedance 2.5与可灵VIDEO 3.0两款热门AI视频模型的表现,分析二者在画面表现、分镜执行、合规风控上的差异,为创作者提供选型参考。

AI科技评论
产品应用8

4K超分Agent修图师来了!一键救活所有模糊照片

传统图像放大模型应对复杂情况力不从心,4KAgent应运而生。它基于多智能体设计,有感知、复原等模块,能为图像定制4K超分方案,在多领域测试中表现出色,无需特定领域再训练。

量子位
新闻资讯7

史上最惨一代?AI延长人类寿命,下一代活到200岁不是梦!

内容创业者Matt Wolfe长期关注AI,他与工程师交流,揭示AI发展现状。巨头各有策略,能源或成瓶颈。AI或带来智能爆炸与生命延长,也可能有‘黑箱语言’风险,还探讨了寿命、机器人等影响。

新智元
开源动态7

Vercel 开源 Bash 工具:基于本地文件系统的上下文检索

Vercel开源bash - tool,为AI智能体提供Bash执行引擎,让其通过shell命令在文件夹操作获取上下文,有三大核心操作,部署灵活,可节省token,贴合Unix工作流,或影响未来AI开发系统处理本地上下文方式。

InfoQ
产品应用8

小说一键转有声剧!豆包语音团队提出「AI多人有声剧」方案,沉浸感拉满了

豆包语音团队发布「AI 多人有声剧」自动化方案,基于多角色 Seed - TTS - 2.0 模型,实现从小说文本到有声剧成品端到端 AI 制作,成本和周期大降,首批有声剧已在番茄小说 App 上线。

机器之心
算法论文8

“神经-符号”融合规划器性能显著超越o1:借鉴人类运动学习机制|中国科学院磐石研发团队

中国科学院磐石研发团队提出新型“神经 - 符号”融合规划器,融合神经与符号规划系统优势,借鉴人类运动学习机制构建双向规划机制,在规划覆盖率和效率上显著超越OpenAI o1,已加入“磐石·科学基础大模型”。

量子位