「麦琪的花园」共找到 10731 篇相关文章

算法论文8

Meta&UIUC大发现:无需标注,Agent复杂的工具使用和搜索能力,是可以“无中生有”的

Meta和UIUC研究发现,无需标注,Agent复杂工具使用和搜索能力可“无中生有”。论文Dr. Zero让大模型自我博弈成搜索专家,用HRPO提效,设计难度导向奖励,实验表现佳,但也存在局限。

深度学习自然语言处理
开源动态8

社区供稿丨如何抑制大模型的“过度反思”:Yuan3.0 Flash 中的强化学习范式

大模型在企业落地时存在“过度反思”问题,浪费算力。YuanLab.ai团队在Yuan3.0 Flash模型中提出RIRM与RAPO,前者奖励“思考过程”,后者优化训练框架,实现推理效率提升,适用于企业场景。

Hugging Face
算法论文8

港大联合字节跳动提出JoVA: 一种基于联合自注意力的视频-音频联合生成模型

香港大学联合字节跳动提出视频 - 音频联合生成框架 JoVA,支持音视频 Token 跨模态交互,引入嘴部区域特定损失解决口型同步问题。实验显示,它用约 190 万条数据就达先进水平。

机器之心
算法论文8

极简主义的胜利:清华团队用最简单的强化学习配方刷新1.5B模型纪录

清华、伊利诺伊大学和上海AI实验室团队提出JustRL架构,仅用单阶段训练和固定超参数,在1.5B模型上刷新性能纪录,计算量仅为复杂方法50%,挑战了复杂技术堆叠现状。

AIGC开放社区
开源动态8

AI 真能看懂物理世界吗?FysicsWorld:填补全模态交互与物理感知评测的空白

多模态大语言模型正经历范式转变,目标是实现全模态协同交互。但现有评测体系难跟上模型发展。飞捷科思和复旦团队推出 FysicsWorld 基准,可评测模型多能力,还提出 CMCS 策略,为全模态智能发展提供指引。

机器之心
新闻资讯7

谷歌创始人罕见反思:低估 Transformer,也低估了 AI 编程的风险,“代码错了,代价更高”

谷歌创始人 Sergey Brin 在斯坦福公开对话中反思,谷歌曾低估 Transformer 和 AI 编程风险。他认为 AI 写代码易出错,更适合创意类工作。还回顾谷歌发展,指出虽有研发积累,但曾投入不足,强调算法比算力更关键。

InfoQ
新闻资讯7

明天,极客公园大会主舞台,7 款今年最值得关注的 AI 产品,速来!

今年极客公园创新大会为7款AI产品策划「线下发布会」,7位创始人登台发布或更新产品。产品涵盖笔记、AI Agent、相机等类型,均有特色亮点,创始人还会分享经验与思考。

Founder Park
算法论文8

突破视觉-语言-动作模型的瓶颈:QDepth-VLA让机器人拥有更精准的3D空间感知

视觉 - 语言 - 动作模型(VLA)在机器人操控领域潜力大,但应对长时序或精细操作任务时性能下降,根源是缺乏三维空间感知与推理能力。中国科学院自动化研究所与灵宝 CASBOT 提出 QDepth - VLA 模型,提升了机器人空间推理与操控精度。

机器之心
开源动态7

最大游戏up主也玩本地AI?让笔记本都能跑大模型的Parallax来了

11月3日,知名游戏博主PewDiePie展示自建本地AI系统,引发全网轰动。本地AI有隐私、性能等优势。Parallax是开源AI项目,挑战“AI必须上云”逻辑,支持异构设备组网和多模型,性能优。

机器之心
推荐文章7

这可能是我见过最“接地气”的 AI 科普:从家政阿姨看懂 Agent 和 MCP

作者以家政阿姨打扫卫生为例科普AI名词,如阿姨比作AI Agent,扫地机器人是SubAgent,智能家居协议对应MCP,《家政技能手册》为Skills,借此辅助解释常见AI概念,助读者理解。

宝玉AI