「密集预测任务」共找到 2361 篇相关文章
Claude Code 网页版曝光, 留给 Lovable 和 Manus 们的机会,可能,不多了
网友发现Claude Code网页版选项,虽被Anthropic撤回,但功能已曝光。它有三种安全级别,处于研究预览阶段,界面功能完整,欲打造云原生开发平台,或改变编程方式,也让竞品压力增大。
改变强化学习范式,Meta新作呼应Sutton「经验时代」预言
图灵奖得主等提出AI智能体将迎「经验时代」,但训练面临挑战。Meta研究用「早期经验」范式解决问题,包含隐式世界建模和自我反思,提升了智能体任务成功率和泛化能力。
「微调已死」再添筹码,谷歌扩展AI自我进化范式,成功经验与失败教训双向学习
近期,‘微调已死’言论引关注。谷歌《ReasoningBank: Scaling Agent Self - Evolving with Reasoning Memory》论文提出类似概念,可让智能体从自身成败经验学习,还引入MaTTS,实验显示其有效性和效率优于基准方法。
经典之作!Agent无需奖励也能学习:通过“早期经验”的Agent Learning
该论文提出‘早期经验’范式,让智能体通过执行动作、观察结果状态学习,无需外部奖励。它能降低数据依赖,提升泛化与鲁棒性。实验显示,其在多样环境中效果出色,为智能体训练提供新思路。
一篇大模型Agentic框架到应用最新综述
这是首篇系统拆解“大模型Agentic推理框架”的综述,不聊训练,只聚焦如何把LLM组织成会思考、协作、调工具的Agent,横跨科学发现、医疗、软件工程、社会经济模拟四大战场,给出统一语言、视角和评测。
科幻!谷歌放出Gemini Robotics-ER 1.5:机器人有了真正的思考力
谷歌推出首个广泛开放给开发者的机器人具身推理模型Gemini Robotics - ER 1.5,可作为机器人高级推理大脑。它能解决物理问题,有新能力如快速空间推理等,还能让开发者平衡延迟与准确性。
KV-Cache 实战策略:生产环境中的分页、固定与复用技术解析
在大语言模型推理场景中,KV - Cache 是平衡性能与成本的核心技术,但生产环境中面临诸多问题。本文聚焦其分页、固定与复用三大战术,结合原理、实践与案例,为开发者提供解决方案,还探讨了未来演进方向。
最好的 DeepResearch 平替开源了
ROMA是元代理框架,以递归分层结构解决复杂问题,有并行问题解决、透明开发等优势。它通过计划 - 执行循环处理任务,介绍了安装选项、技术栈,还有预构建代理展示功能。
三大核心创新公开,快手开源多模态Keye-VL 1.5拿下视频理解SOTA,8B力压GPT-4o!
快手开源多模态Keye-VL 1.5,为8B视频理解最强模型,公开3大核心创新技术。它靠Slow-Fast视频编码等,在20+基准屠榜。在多类基准测试和内部测评中表现优异,将业务经验沉淀到开源社区。
每个token都在亏钱,但ARR9个月破亿!从烧光现金、裁掉一半员工到反杀Cursor,Replit CEO曝一年内如何极限翻盘
2024年初到2025年9个月内,Replit的ARR从不到1000万美元突破1亿美元。其增长基于系统性战略,从基础设施整合发力。创始人分享发展历程,还谈到AI编程趋势及产品边界等内容。