「Strands Agents V1.0」共找到 4710 篇相关文章
Agent 不是渐进升级,而是要“换代”了:Cursor 工程负责人放话未来三到六个月,行业将迎来大变局
本文是对Cursor工程负责人Jason Ginsberg的访谈。他认为编码Agent正换代,未来三到六个月行业将大变,会接管复杂任务。还谈及编码Agent发展、Cursor使用方式、交互模式等,分享了产品开发、审查等看法。
混元开源PhoneBuddy-4B与5篇系列论文:多项手机Agent真机评测超过GPT-5.4
腾讯混元Phone - use Agent团队发布PhoneBuddy - 4B及5篇系列论文。研究探讨如何训练真实可用的Phone - use Agent,采用Real + Mock方式,实验显示该方法提升效果显著,4B模型多项任务超GPT - 5.4。
1.5B推理模型新SOTA,RL训练新解法打破「简单题过拟合、难题学不动」的魔咒
QuestA通过在训练中注入解题提示,实现两项成果:在1.5B模型上实现Pass@1的SOTA性能,还提升了Pass@k性能。它解决了RL训练中简单与困难任务的权衡问题,为开发强推理模型打开大门。
Openai-o3 做不到的事,7B 模型做到了! 推荐系统“慢思考”,广告收入暴涨 4.1%
随着GPT - 4等大语言模型兴起,LLM用于推荐系统遇瓶颈,当前方法停在‘System - 1思维’阶段。A4ec框架把LLM从‘快思考’升级到‘慢思考’,用7B模型实现推荐系统升级,使广告收入暴涨4.1%。
反超Gemini 3!马斯克放出Grok4.1快速推理版,还曝出了新一轮150亿美元融资
Grok4.1被Gemini 3反超后,据华尔街日报爆料,xAI正计划150亿美元融资,公司估值将达2300亿美元。xAI成立两年多来估值飙升,马斯克还发布Grok 4.1 Fast击败Gemini 3。
Fable 5 订阅权限又续了 5 天!与其被吊着,我找了个账单只有 1/3 的替代方案
Anthropic将Fable 5订阅权限延长至7月12日,但使用不稳定且价格贵。作者介绍OpenSquilla 0.5.0 Preview,其多模型集成协作方案用国产模型组队,成本低且分数可与Fable 5打平,不过也有适用边界。
我去,真有这种,Openclaw 增强工具,ClawRouter 让 AI Agent 自己选模型、自己付钱,还能把 LLM 成本打下来 90%,爽~~
ClawRouter是开源本地LLM Router / Proxy,支持55+模型,能让AI Agent自动选模型、付费,将LLM成本降90%。它解决路由、支付等问题,适合做AI Agent、编程工具等产品的开发者。
一年磨一剑,今年最炸机器人Demo来了!1亿美元种子轮团队出手,单个模型解锁单手打蛋解魔方弹钢琴
Genesis AI发布机器人基础模型GENE - 26.5,让机器人可自主完成烹饪、实验室操作等复杂任务。该团队全栈自研,从硬件、数据、模型到训练评估都有独特方案,曾获1.05亿美元种子轮。
智谱首秀工程实战经验!Coding Agent日均数亿次调用,GLM-5把长上下文推理的底层问题全逼出来了
今年 2 月智谱 GLM Coding Plan 上线后很受欢迎,随着用户和调用量上涨,Coding Agent 成压力测试场。4 月 30 日智谱发布博客,披露 GLM - 5 系列模型在超大规模 Coding Agent 调用场景下的底层推理技术突破及工程实践经验。
大模型狂叠 buff、Agent乱战,2025大洗牌预警:96%中国机器人公司恐活不过明年,哪个行业真正被AI改造了?
InfoQ编辑部发布《2025年度盘点与趋势洞察》,探讨大模型、Agent等领域变化,分析行业被AI改造情况。指出2025年格局重塑,竞争焦点转变,国内AI有进展但与硅谷有差距,还介绍了大模型、Agent、AI Native等发展趋势。