「工具集成强化学习」共找到 2848 篇相关文章
OpenClaw 火了半年,Agent 执行层依然是工程空白
当前主流 Agent 工具链执行层基本空白,Violoop 是少数在执行层做系统化设计的项目。它是桌边触屏硬件,获取三类运行时数据,具备感知 - 判断 - 执行运行时,有多种核心能力,适合特定场景团队评估。
5Y News|Kimi发布并开源 K2.5 模型,带来全新视觉理解、代码和Agent集群能力
2025年1月27日,月之暗面发布并开源Kimi K2.5模型,它是迄今最智能全能的模型,在多任务有出色表现。支持多模态输入,具备新能力,还推出Kimi Code工具,集群能力也开启Beta测试。
社区供稿丨AgentCPM-Explore开源,4B 参数突破端侧智能体模型性能壁垒
清华大学、中国人民大学等联合研发的 AgentCPM-Explore 智能体模型开源,它基于 4B 参数,在深度探索类任务表现佳。有打破参数壁垒等亮点,还开源配套工具,提供应对小模型挑战方法,邀伙伴共建生态。
Anthropic 断供,国产 Coding 模型的中场战事开启
Anthropic对中国企业断供,国产模型面临成为Claude平替的机遇。Kimi等模型纷纷尝试,Kimi K2 0905版本在编码、上下文及工具调用上提升,其终极目标或构建具Agent特质产品,未来Agent是决胜场。
Windsurf快被Devin搞垮了!bug 不断、官方“装死”,百万用户要“跑”了?
Windsurf近期出现性能降低等问题,社区抱怨不断,但官方却隐身不回应。此前公司经历变动,Devin集成到Windsurf后问题频出,如级联错误、积分消耗等,部分用户开始转向其他产品,其未来发展存不确定性。
AI摧毁就业?DeepMind CEO:这是一场比互联网更猛的职业洗牌
谷歌DeepMind CEO Hassabis认为AI虽可能颠覆职场,但会创造新工作,提高生产力。他强调学习STEM、上手AI工具的重要性,也指出AI缺乏“安全护栏”,需全球公约监管,还乐观期待AI让人类不再自私。
DiffMoE:动态Token选择助力扩散模型性能飞跃,快手&清华团队打造视觉生成新标杆!
清华大学和快手可灵团队推出DiffMoE,通过创新的动态token选择机制和全局token池设计,拓展了扩散模型的效率与性能边界。实验表明,DiffMoE在多方面超越现有模型,未来集成先进技术或有新增益。
突发!OpenAI紧急暂停GPT-6训练
OpenAI奥特曼官宣暂停下一代旗舰模型强化学习训练两周,原因是确保安全等标准跟上能力水平。触发因素有Hugging Face事故和Astra达安全红线,后续将让AI监管AI,加固三道安全防线。
一位资深 Builder的自述:我如何借多 Agent 开发工作流,一周做出 MVP、一个月上线
资深Builder手工川分享开发经验,他99%代码由AI完成,认为需求、产品判断等比技术重要,爱生活易发现大众需求,还介绍了开发流程、多Agent协作难题及YODA开发工具等。
只有5%AI项目在挣钱!MIT最新报告印证奥特曼警告
MIT联合英伟达发布的AI商业分析报告显示,仅5%的AI项目能创造百万美元价值,其余在亏损。AI项目落地难,因工具与场景有差距,企业自研成功率低,投资也偏向前端职能。