「长任务智能体」共找到 5351 篇相关文章
豆包大模型 Seed 2.0,有点不一样
大模型升级频繁令人审美疲劳,但豆包大模型Seed 2.0不同,其核心是Skills调用能力。作者测试了它做的小红书长图文排版生成器和古文翻译器,还体验了APP“专家模式”,展现多模态理解优势。
Agent 真正的护城河,正在从工具转向记忆资产
2026年初,Anthropic用Claude Cowork引发AI创业热点,其计划引入知识库获“永久记忆”能力,将Agent Memory探索推到前沿。文章探讨独立Memory层成必需品的原因、工程化记忆系统的能力,还对比模型厂商和第三方中立派路线。
硅谷深夜不写一行代码!放羊大叔Ralph引爆奇点,睡一觉AI全跑通
放羊大叔Ralph Loop掀起生产力革命,无需手写代码,AI就能搞定软件开发。它把任务拆到最小颗粒度解决普通AI崩溃痛点。还介绍融入工作流的方法、运行方式及成本,强调掌握此技能的重要性。
中国科技企业出海的6条最新趋势!
作者在美国拉斯维加斯CES展及硅谷调研后,总结了AI和中国科技企业出海的6条趋势,包括Token消耗激增使自研成大势,AI提升消费电子产品溢价,软硬件边界模糊等。
1秒30000元,台积电的光刻机,就快“冒烟”了
1月15日台积电公布2025年第四季度财报,营收、净利同比大增,预计2026年营收增近30%。先进制程营收占比高,HPC贡献大,2nm量产等或改变营收分布,先进封装贡献将提升,资本支出也将增加。
老黄挤爆牙膏!DLSS 4.5狂飙6倍,RTX 50系直接封神
2026年CES大会上,英伟达发布DLSS 4.5提升画质与帧生成,RTX Remix助力经典游戏重生,还将NPC变智能伙伴。同时,其软件升级利好AI PC,提升性能、减少显存消耗,让它更接近日常使用。
这可能是,全球最强开源Agent模型,走了一条反Scaling Law的全新范式!
MiroThinker v1.5开源,其30B小模型在Agent benchmark上击败万亿参数的Kimi K2T。它以交互深度为新Scaling维度,训练有严格时间管控,实测表现超Search Agent,“小模型+强交互”或成新方向。
AI 真能看懂物理世界吗?FysicsWorld:填补全模态交互与物理感知评测的空白
多模态大语言模型正经历范式转变,目标是实现全模态协同交互。但现有评测体系难跟上模型发展。飞捷科思和复旦团队推出 FysicsWorld 基准,可评测模型多能力,还提出 CMCS 策略,为全模态智能发展提供指引。
为什么Agent总是Demo猛如龙实战一条虫?
一篇51页论文研究主要智能体,指出适应性是关键。它提出2×2分类框架将适应方法分四大范式,还明确不同范式优缺点,发现T2范式数据效率远超A2。最后点明Agent适应性研究的四个前沿方向。
破除AI Agent自主操控风险:万字解读LangGraph“人工干预”机制 ,附零基础实战
随着LLM驱动的Agent从学术走向应用,确保其行为的可靠性、安全性与可控性成关键挑战。文章以LangGraph为例,介绍其人工干预机制的核心原理、四大经典模式及案例实践,助开发者构建可靠、安全的智能代理。