「长时任务」共找到 2910 篇相关文章
为什么你的 AI Coding 账单越涨越快?十个节约 Token 的工程办法。
文章指出今年大模型Token账单涨得快,尤其AI编程重度用户。从工程角度总结降低Token消耗的方法,如上下文清场、代码导航等,还分析AI Coding的Token变贵原因及各方法适用边界。
Kimi推出超实用插件!让AI真正像你一样操作浏览器
月之暗面推出Kimi WebBridge浏览器扩展插件,让AI Agent像用户一样操作浏览器。它采用本地优先路线,保障安全,可实现信息采集等自动化操作,还能创建CLI工具,是AI浏览器自动化趋势的重要成果。
这是我见过最全的免费 LLM API 指南,正规合法、开箱即用!
个人开发者在使用LLM API时面临成本高、资源杂乱、稳定性差等问题。Github上项目`free-llm-api-resources`整合全网正规免费资源,排除不合规服务,介绍主流模型、限制说明等,值得收藏。
让大模型自己写代码、自己进化,GIM和港大这篇ACL主会,把量化因子挖掘重做了一遍
香港大学和GIM提出CogAlpha框架,将Alpha从‘公式’升级为‘代码’,搭建7层21个智能体探索体系,让大模型参与研究流程。在5个数据集上跑赢21个基线方法,还具可解释性。
阿里SkillClaw:让 Agent 技能在真实使用中集体进化
当前LLM Agent依赖可复用技能完成任务,但技能部署后静态不变,改进仅停留在当前会话。阿里SkillClaw提出中心化进化架构,将多用户交互作为技能改进信号,通过Agentic Evolver更新技能,经夜间验证后部署。
明略科技吴明辉:企业级Agent的“精度陷阱”与人机协同重构之路
2025 年 12 月 19 日,明略科技创始人吴明辉在 AICon 大会分享《可信 Agent 的规模化之路》。他指出企业级 Agent 存在“精度陷阱”,建议重新设计人机分工,让 AI 执行 Task,人定义目标、校验结果、审计逻辑。
OpenAI 也把工程师经验“蒸馏”进 skill 了!Harness 爆文作者曝内部玩法:一个百万行代码系统,全程零人工编码和审核
OpenAI的Ryan Lopopolo分享Frontier团队工作方式,他们维护超百万行代码库,零人工编码和审核。实验产出Symphony,推动coding agent成“队友”。还探讨模型使用、构建速度、人类角色等问题,认为人成瓶颈,软件要适配模型。
突然袭击!刚刚,Meta超级智能团队首个大模型来了
Meta超级智能实验室推出首个模型Muse Spark,由Alexandr Wang带领团队打造。它具备多能力,定位为构建个人超级智能基础,在多方面表现出色,Meta还研究其扩展维度。
一场机器人黑客松,让具身智能的差距与机会同时显形
作者参加深圳机器人黑客松,这是全球最大规模线下具身智能开发者大赛之一。3天内参赛队伍可完成从数据采集到真机部署闭环。比赛让行业差距与机会显形,凸显基模重要性,自变量也给出新方向。
字节版龙虾架构火爆GitHub!开源获35k+ Star,内置Skill全家桶,原生适配飞书
字节开源Deer - Flow2超级智能体管理框架,登上GitHub Trending榜首,获35.3k Star。它采用模块化多智能体架构,主打开箱即用,扩展性强,适配多种IM渠道,还介绍了核心能力、部署方式等。