「长时程Agent」共找到 3222 篇相关文章
大模型能“原地”改参数了!字节Seed&北大新论文:测试时推理无需加层重训练
字节Seed和北大研究团队提出In - Place TTT方案,让大模型能“原地改参数”。它复用Transformer的MLP模块,解决现有TTT架构不兼容、计算效率低和优化目标不匹配问题,实验证明可提升模型长文本任务表现。
Langchain创始人最新分享:如何跨越“原型惊艳”到“生产可靠”的鸿沟
近日,LangChain创始人Harrison Chase在Interrupt大会演讲,指出AI行业‘原型易,生产难’痛点。分享优秀Agent工程师四大素质、智能体开发三大关键,还介绍战略预判与产品布局,致力于为智能体工程师提供全周期支持。
AI在「赚钱锦标赛」夺冠,比人类还会做生意!躺赚时代要来了?
研究人员提出自动售货机运营模拟环境Vending - Bench,测试大模型智能体管理业务能力。实验显示不同大模型性能方差大,Claude 3.5 Sonnet净资产表现最佳,人类基线在可靠性上表现较好,各模型长周期表现波动大。
红杉、顺为、米哈游等数亿融资,前大疆员工做了款消费级纺织机,目前营收近亿
消费级智能纺织公司浪爪智能获红杉、顺为、米哈游等数亿融资,创始人胡文鑫出身工程师。团队专注消费级纺织 DIY,推出消费级纺织 Station 平台,还在研发纺织 AI Agent,此前产品已获近亿营收。
Anthropic深夜连放两弹:Sonnet 5、全新AI科研App重磅上线
Anthropic 深夜发布两个重磅更新:Claude Sonnet 5和面向科研人员的AI工作台Claude Science。Sonnet 5性能接近Opus 4.8,提升Agent能力且价格低;Claude Science整合科研工具,支持复现产出、自动管理算力、多学科查询。
搜索已死?被AI投毒搞怕了的我开始重新看待百度
作者辅导孩子背诗遇读音疑问,问AI结果更懵,百度则给出清晰准确答案且标注来源。原因在于AI基于大模型‘概率预测’易‘编答案’,百度用‘双层Agent’架构结合内容治理,答案更靠谱。
劝视频博主别拿龙虾起号,7×24小时全自动,碳基生物真卷不过
X上网友分享的AIVideo Agent可7×24小时全自动完成视频制作流程,上手无技术难度,还能与多平台集成。AIVideo.com功能全,实测生成速度快且操作空间大,或改写传统视频生产流程。
Kimi K2 Thinking突袭!智能体&推理能力超GPT-5,网友:再次缩小开源闭源差距
Kimi K2 Thinking发布并开源,主打“模型即Agent”,能边思考边用工具,连续工具调用200 - 300次。在多评测基准超GPT - 5等闭源模型,代码权重遵循MIT协议,可在官网和应用实测。
DeepSeek V4「满血版」曝光了!最快明天发布
全网等近三个月,DeepSeek V4正式版或最早明日发布。有Flash和Pro两版本,开发者评价其性能接近Opus 4.8,Agent能力增强。首轮测试外流,评价不一。还将引入「峰谷计费」,性价比仍高。
AI越用越聪明,自主+自进化是关键拼图丨盛大邓亚峰EverMind@AIGC2026
在AIGC2026峰会上,盛大集团邓亚峰指出,AI范式从Chat转向Agent,未来AI需“自主”与“自进化”,长期记忆是关键。EverMind团队基于此研发相关技术,成果显著,还提出个人记忆主权等观点。