「Agent推理」共找到 4505 篇相关文章
牛B, 我真的起飞啦,6.4k Star Bright Data CLI~~~~
约6.4k Star的Bright Data CLI想解决AI Agent访问网页难题,把网页变成易被模型读懂的材料。它将网页访问能力拆成终端可组合动作,还关注工程化细节,让Agent上网有章可循。
奥特曼:ChatGPT只是意外,全能AI智能体才是真爱!Karpathy:7年前就想到了
当全球为ChatGPT喝彩,OpenAI的MathGen团队秘密锻造AI「推理」能力,打造全能AI智能体。OpenAI坚信推理能力可复制到各领域,未来AI智能体将颠覆一切,如今围绕人才的战争已白热化。
Anthropic 断供,国产 Coding 模型的中场战事开启
Anthropic对中国企业断供,国产模型面临成为Claude平替的机遇。Kimi等模型纷纷尝试,Kimi K2 0905版本在编码、上下文及工具调用上提升,其终极目标或构建具Agent特质产品,未来Agent是决胜场。
MiniMax重磅开源M1模型:百万上下文超DeepSeek R1,实现性能与效率双杀
MiniMax正式开源首个推理模型M1,原生支持百万级上下文长度,在推理效率、计算成本和复杂任务能力上有独特表现。其在性能和效率上超越DeepSeek R1等模型,还提出创新强化学习算法。
“龙虾”也需要看病?一张旧病历,引出三个新确诊
本文是悟空Agent泛化能力系列先导篇,以OpenClaw项目为例,介绍其通过不同泛化策略发现三个新漏洞,还总结实践原则。强调研究泛化能力对防御漏洞的重要性,4月底悟空Agent将开放试用。
这可能是Claude Code最重要的功能
Claude Code新功能Sub - agents很实用,能创建多个专精任务的Agent,有独立上下文窗口防‘记忆污染’,配置灵活,还能组成工作流。创建简单,比社区项目有优势,是Claude Code截至目前最重要功能。
具身导航,感知推理到底是「上帝」,还是执行控制是「命门」?| GAIR Live 023
本文是GAIR Live 023圆桌对话实录,浙江大学彭思达与具身多模态算法专家郝孝帅探讨具身导航。涉及本质、范式、挑战、交互等方面,还对未来5 - 10年发展做了展望。
可塑的计算机Omarchy爆火硅谷,龙虾之父自掏100万投资
Ruby on Rails 作者 DHH 推出 Linux 发行版 Omarchy,将 AI agent 嵌进系统底层,有独特设计和功能。自带安装脚本,安装快。获十位大佬各 100 万美元赞助,多家系统也在探索 AI 嵌入,它有望开启 Agent OS 时代。
腾讯提出Vision-SR1:让模型真正学会“看图思考”,而不是“蒙答案”
视觉语言模型(VLMs)存在视觉幻觉和语言捷径问题,限制其可靠性和泛化能力。腾讯提出Vision - SR1训练方法,通过推理分解和自我奖励机制,不依赖外部监督,提升模型视觉感知和推理可靠性。
跨境电商版Sora发布:全球首个AI原生电商视频Multi-Agent来了
营赛AI发布跨境电商版Sora——inSai Hilight。它无需拍摄素材与复杂提示词,扔个商品链接或图,20 - 30分钟就能生成逻辑严密、商品还原度100%、符合TikTok爆款节奏的营销视频,重新定义电商营销视频生产方式。