Agent推理」共找到 4573 篇相关文章

开源动态7

GitHub MCP 注册中心提供了一个发现和部署 MCP 服务器的中心枢纽

GitHub 推出 MCP 注册中心,旨在帮开发者发现和使用 AI 工具,简化 AI agent 连外部工具的过程。它列出 40 多个 MCP 服务器,还展示受欢迎程度。此外,Docker、Postman 等也有相关目录。

InfoQ
算法论文8

告别微调!腾讯提出Training-Free GRPO:无需更新参数,还能保证泛化性,成为传统RL的有力替代

大型语言模型在专业领域表现不佳,传统微调方法成本高、易过拟合。腾讯优图实验室提出Training - Free GRPO,无需更新参数,通过上下文学习提升性能,成本低且泛化性好,是传统强化学习有力替代。

深度学习自然语言处理
算法论文8

GPT-6 或有"生命"!MIT新作实现LLM自我进化,冻结权重时代终结

MIT新作《Self-Adapting Language Models》实现LLM自我进化,SEAL框架让模型自己生成“自编辑”微调自身。它能实时学新数据、修复知识、形成记忆。经两种场景验证,小模型也能超越GPT - 4.1等。

PaperAgent
算法论文7

「微调已死」再添筹码,谷歌扩展AI自我进化范式,成功经验与失败教训双向学习

近期,‘微调已死’言论引关注。谷歌《ReasoningBank: Scaling Agent Self - Evolving with Reasoning Memory》论文提出类似概念,可让智能体从自身成败经验学习,还引入MaTTS,实验显示其有效性和效率优于基准方法。

机器之心
新闻资讯7

惊爆提示词漏洞?Prompt 工程师开始失业

Noma Labs披露Salesforce Agentforce的“ForcedLeak”链式漏洞,攻击者串联“提示注入”致敏感数据外泄。ESET也报告AI勒索软件PromptLock。Prompt正转向Context,Prompt工程师或失业,价值向能组织语境流程者转移。

MacTalk
新闻资讯7

GPT-5通过“哥德尔测试”!独创性解决博士生都得花几天时间的开放数学问题

最新论文中,研究人员让GPT - 5挑战5个未解决的优化猜想,它解出3个,还对一题给出不同有效证明方案。测试题需博士水平研究者花几天完成,研究还“挑衅”了陶哲轩对大模型数学能力的印象。

量子位
算法论文8

理解帮助生成?RecA自监督训练让统一多模态模型直升SOTA

统一多模态模型在视觉理解和生成能力上不平衡,常理解强但生成弱。本文提出重建对齐(RecA)自监督后训练方法,不改动架构,用未标注图像训练,在多模型实验中提升性能,部分达SOTA。

机器之心
新闻资讯7

Cursor定价又更新,直接变成" 买API ",Coding 产品包月模式走不下去了

Cursor一年三变价,9月15号后个人版按模型推理用量计费,有Pro、Pro Plus、Ultra方案,还对大学生免费计划二次验证。因模型成本涨、竞争大,包月模式难以为继,多家编程工具都调整定价。

AI进修生
推荐文章8

2 亿美元 ARR,AI 语音赛道最会赚钱的公司,ElevenLabs 如何做到快速增长?

AI音频独角兽ElevenLabs估值66亿美元,从“小公司”成长为独角兽。其CEO回顾创业历程,分享心得,如结合研发与产品、融资绑定产品动态、靠三点优势不被OpenAI取代等,还谈及人才、融资、业务等方面策略。

Founder Park
产品应用8

腾讯版“Claude Code”来了!AI编程L4时代is coming

9月9日腾讯发布AI CLI工具CodeBuddy Code,CodeBuddy IDE开启公测。它是腾讯版“Claude Code”,可自然语言驱动开发运维。随着AI编程发展,CLI成基础设施,CodeBuddy代表企业级AI编程新方向。

量子位