麦琪的花园」共找到 10488 篇相关文章

算法论文8

复旦、同济和港中文等重磅发布:强化学习在大语言模型全周期全面综述

来自多所顶尖科研机构研究者完成长文综述,总结大语言模型全生命周期强化学习研究,阐述其各阶段应用策略,分析未来挑战与趋势,重点关注 RLVR 技术,有全生命周期梳理等三大贡献。

机器之心
开源动态7

AI 剪完整条视频,却没看过一帧:背后是所有 agent 都在用套路

browser - use团队开源video - use项目能让Claude自动剪辑视频,且AI不看视频帧,靠处理文本完成。这是当前聪明agent产品通用做法,还给出判断AI agent三个问题及思路。

AI Reading Hub
算法论文7

多模态大模型理解物理工具吗?PhysToolBench提出了衡量多模态大模型对物理工具理解基准

香港科技大学等团队提出 PhysToolBench,用于衡量多模态大模型对物理工具理解。它将理解分为三个等级,测试 32 个模型,揭示了大模型在工具理解上不足,也为未来发展指明方向。

机器之心
开源动态8

仅10行代码,轻松打通你AI应用与DB:谷歌开源数据库MCP,Star突破4.6k

谷歌开源面向数据库MCP Toolbox,位于应用编排框架和数据库间,处理连接池等复杂问题,简化工具管理。它能助开发者构建让智能体访问数据库Gen AI工具,有开发简便等优势。

PaperAgent
7

3个月手搓Gamma架构,这个团队打造出了场景白盒化推理“下一代内容OS”

AI应用从生成范式转向任务执行范式,Pi团队3个月手搓Gamma架构,打造出场景白盒化推理“下一代内容OS”。Pi将AI生成与人编辑能力结合,解决传统创作难题,实现创作全流程系统内闭环。

量子位
算法论文8

为什么BF16FlashAttention会把训练「炸掉」?清华首次给出机制解释,用极简改动稳住训练

社区里长期存在FlashAttention+BF16训练GPT - 2时loss突然爆炸问题,清华团队论文给出机制解释。指出是特定条件下数值偏置被放大所致,还给出极小修改稳定训练,且在多模型和硬件上验证有效。

机器之心
产品应用7

对话小鹿光年创始人许婷:超七成付费人群是子女,AI回忆录「隔代」生意经

本文是对小鹿光年创始人许婷访谈。许婷介绍了AI回忆录产品小鹿光年,称超七成付费人群是子女。还谈及产品流程、优势、用户画像等,也分享对赛道发展看法,认为创业者晚几年入局或更合适。

AI科技评论
算法论文8

比RAG高出8.9%,百度TURA:让搜索引擎“动”起来下一代AI Agent架构

现有检索增强生成(RAG)系统只能读取已索引静态网页,无法满足用户需实时数据问题。百度TURA用工具调用把RAG升级为动态交互,其核心分检索、规划、执行三步,已在百度亿级流量场景跑通。

PaperAgent
推荐文章8

Pokee.ai 朱哲清:用 RL 搭建智能体「骨骼与神经」| AI 产品十人谈

《AI 产品十人谈》对话 Pokee.ai 朱哲清,探讨强化学习与 Agent。朱哲清是强化学习信徒,曾带领 Meta 团队突围。他认为单靠预测难完成复杂任务,强化学习是超人类智能关键,介绍了 Pokee.ai 产品优势及对通用 Agent 看法。

AI科技评论
推荐文章7

把方法论装进 AI:从这场 Skill 黑客松里,我们找到了 6 个值得参考样本

本文介绍了 Founder Park 联合扣子举办 Skill 招募大赛。大模型干活不稳定,Skill 提供解决路径,把 prompt engineering 变成可积累资产。文中展示获奖 Skill 案例,还介绍扣子构建 Agent 生态,指出其改写专业知识分发方式。

Founder Park