「成本性能」共找到 6987 篇相关文章
TACO: 让 CLI Agent 在自主迭代中学会丢掉无用上下文
由多校及研究团队联合提出 TACO,这是无需训练、即插即用的终端智能体自进化观测压缩框架。它能让智能体学习压缩规则,过滤低价值输出,保留关键线索,实验显示其提升了任务成功率和 token 效率。
3.6K Star!OpenCode 团队开源宝贝,模型价格、能力、规格一网打尽!
开发AI应用时,模型选择成难题,信息碎片化、不透明让人头疼。OpenCode团队开发的开源项目Models.dev,整合主流模型关键信息,可一站式查询、精确估算成本、对比能力,还提供公开API,社区驱动持续更新。
Cursor SDK正式发布,“cursor” inside!
四月最后一天,Cursor正式发布TypeScript SDK,将智能代理运行时打包成可编程组件,跳出编程工具定义。它提供完整开发套件,支持双模部署,已有公司用其做三件事,还包含关键部分,Composer模型开放有战略价值。
超越VLA与世界模型,银河通用发布LDA,全谱系数据跑通Scaling Law
近期具身智能领域竞争激烈,银河通用联合多机构发布 LDA-1B 模型,能统一利用各类具身数据。它在基准测试中表现出色,代码已开源,还解决了数据格式、质量等问题,实战效果也很突出。
GPT5.5 + Codex 如何跑一整夜,编程的下一步,不是辅助编程,是可托管执行单元
文章指出GPT - 5.5在Codex里展现出强大自主性,能处理长时程任务。还介绍让其跑长任务的方法及面临的问题,强调长任务需状态机、证据链等,社区也在构建相关工作流层。
Harness不是目的,知识才是护城河 —— 一个AI工程交付团队的知识沉淀实践
本文指出构建Harness工作流非最终目的,私域和团队知识沉淀才是技术护城河。分享AI Team工程交付编排系统中知识分层架构设计、团队知识库共建共享、工作流成知识沉淀载体、突破人机交互瓶颈及落地经验与思考。
97年金融男带8只「电商龙虾」全球开店!2个月后同行慌了
阿里版「电商龙虾」Accio Work打通国际站,一个工作台可全包选品、发品等七个岗位的活。它结合多维度数据助力选品,还能进行广告诊断、店铺运营等,在不同商家案例中成效显著。
谷歌向左、李飞飞往右,阿里世界模型「快乐生蚝」杀出第三条路
阿里推出世界模型HappyOyster(快乐生蚝),基于原生多模态架构,有漫游和导演两大核心功能,可实时构建和交互。与文生视频模型不同,它能随时被干预。虽世界模型尚处早期,但应用场景广泛。
Claude Design连夜突袭,Figma市值瞬间蒸发!或抢走全球UI设计师饭碗
Claude实验室推出Claude Design功能,只需输入一句话就能生成可交互完整原型,让Figma等设计公司股价跳水。它或让画图动作消失,引发对设计师职业是否会被取代的思考,Anthropic还在下更大的棋。
6行代码搞定AI Agent记忆!这个16K Star的开源项目打破了传统RAG痛点!
传统RAG方案有上下文断裂、检索不精准等问题,而开源项目Cognee用6行代码就能给AI Agent构建持久化记忆系统。它结合向量搜索和图数据库,形成统一记忆层,支持30+数据源,有多种核心API。