多模态处理能力」共找到 4467 篇相关文章

算法论文8

大型语言模型稳定强化学习的新路径:几何平均策略优化GMPO

本文介绍了大型语言模型稳定强化学习新路径——几何平均策略优化GMPO。它是GRPO稳定化版本,通过优化几何平均替代算术平均,解决GRPO训练不稳定问题,在多任务实验中显著优于GRPO。

机器之心
开源动态8

16K星 Zep凭一张“动态记忆图”吊打一众Graph RAG

现有的RAG框架多依赖静态文档检索,无法满足企业对动态知识整合的需求。本次分享的Zep提供新型智能体记忆层服务,通过核心组件Graphiti动态整合数据,在LongMemEval基准测试中表现出色。

CourseAI
新闻资讯7

用户集体大逃亡!Cursor“自杀式政策”致口碑崩塌:“补贴”换来的王座,正被反噬撕碎

很多开发者吐槽并弃用 Cursor,因其付费后砍功能、技术变差、营销像‘障眼法’,引发信任危机。部分用户转向 Claude Code,不过企业侧使用情况有差异。AI 编程工具竞争激烈,需多维度构建优势,市场未来趋势明显。

AI前线
新闻资讯8

Anthropic CEO最新采访:AGI一词毫无意义、点名扎克伯格、谈开源、家庭……等八个非共识观点

Anthropic CEO Dario Amodei在采访中给出八个非共识观点。他认为AGI和ASI是空洞概念,年亏30亿美元是投资,开源作用被高估,还谈及公司应对挖角、竞争、市场定位等策略,展现独特领导风格。

AGI Hunt
产品应用7

让小爱音箱超越「指令-响应」模式,开启真正智能交互新时代

2017年智能音箱诞生,却被困于「指令 - 响应」模式。此次Open - XiaoAI进化,接管小爱音箱“耳朵”和“嘴巴”,通过多模态大模型和AI Agent释放其潜力,还给出项目运行教程等。

GitHubStore
算法论文8

首个可学习姿态对齐的视频扩散模型!StableAnimator++

当前人像动画扩散模型在人物身份一致性上表现不佳,复旦大学联合多团队提出StableAnimator++,它是首个可学习姿态对齐的视频扩散模型,能生成自然保真的人物动画,还在保持人脸一致性上做了改进。

带你学AI
产品应用8

AI 集成的智能 Profiling 实践:从性能分析到优化闭环

本文由韩钦亭撰写,分享了在已有 Profiling 平台引入 AI 智能辅助模块的实践。介绍了设计思路、工程实现、应用成效,对比不同大语言模型,通过实际案例展示优化效果,还探讨了 AI 在性能优化场景的未来潜力。

InfoQ
新闻资讯8

刚刚,斯坦福宣布发起首个AI 主导学术会议

斯坦福大学James Zou教授宣布Agents4Science 2025会议,这是首个要求AI作主要作者和审稿人的学术会议。会议玩法独特,有三大目标,顾问委员会豪华,引发网友热议,将于2025年10月22日虚拟举行。

AGI Hunt
新闻资讯7

CS专业爆冷,失业率达艺术史2倍!年入千万只需5年,大学却在禁Cursor

在AI浪潮下,CS专业情况两极分化,25岁辍学生用不到2年打造百亿美金Cursor,而CS毕业生失业率达艺术史2倍。美国创业机构YC举办圆桌讨论,探讨AI时代职业选择、学校价值等问题。

新智元
开源动态8

谷歌让机器人「长脑子」了!首发离线具身VLA模型,断网精准操控

谷歌首发具身智离线模型Gemini Robotics On-Device,实现VLA多模态大模型在具身机器人本地离线运行,无网络也能稳定运行。谷歌还开源了SDK,具身智能迈向实用化新阶段。

新智元