「多智能体模型」共找到 10866 篇相关文章
LeCun有了新证据!大模型思考与人类思考存在本质差别
Yann LeCun参与的研究用信息论揭示大语言模型与人类在‘理解世界’上的本质差异。研究引入新量化框架,分析主流大模型,发现AI与人类在‘理解’上有三大核心差异,对当前AI发展趋势提出挑战。
魔法原子,105亿瞄准具身智能终局
2026 年很多行业被 AI 重塑,具身智能赛道尤为明显。魔法原子推动生态基金布局,撬动超 105 亿资金,完成 5 亿融资。它推进多维度‘连接能力’,构建系统能力与落地场景,成资本与行业关注样本。
3.6K Star!OpenCode 团队开源宝贝,模型价格、能力、规格一网打尽!
开发AI应用时,模型选择成难题,信息碎片化、不透明让人头疼。OpenCode团队开发的开源项目Models.dev,整合主流模型关键信息,可一站式查询、精确估算成本、对比能力,还提供公开API,社区驱动持续更新。
毫秒响应延迟!开源统一语音对话模型Voila
Voila是开源统一语音对话模型,能以自发、实时且有情感的方式与人类互动。它采用全新端到端架构,响应延迟仅195毫秒,支持超百万种预构建声音,适用于多种语音应用。
Monet:赋予多模态大模型如人类一般的抽象视觉思考能力
文章介绍了Monet模型,它实现了训练MLLM直接在连续隐空间思考的方法,内化视觉思考能力。还阐述了多模态模型隐式推理训练的难点,提出SFT+RL训练框架,构建数据集,经测试,Monet提升了视觉推理能力。
Anthropic训了一个10万亿参数的模型,然后说:太危险了,不卖
Anthropic发布10万亿参数新模型Claude Mythos,因其网络安全能力过强不公开发布,联合12家科技巨头开展Project Glasswing计划,让企业用其查系统漏洞。模型性能提升显著,还能突破沙箱,引发各方关注。
用 1/1000 的参数打穿大模型:我为什么强烈推荐 PaddleOCR
PaddleOCR是百度开源的OCR工具,模型参数仅0.07B,却能在复杂场景媲美大模型精度。其新一代PP - OCRv5全面升级,在文本检测等方面表现出色,还稳定增长且在海外受关注。
AI 编程 2025 总结:国产模型“能力追平”,国产编程工具还在“情感陪伴”
文章总结2025年AI编程发展,指出国产编程模型能力追平、工具与模型开放集成等六大趋势,同时提到AI替代重复劳动、提升核心能力门槛,呼吁2026年关注工程确定性。
机器人界的「Imagenet 时刻」,李飞飞团队官宣全球顶级具身智能挑战赛
李飞飞团队与斯坦福AI实验室官宣首届BEHAVIOR挑战赛将登陆NeurIPS 2025。这是具身智能“超级benchmark”,涵盖1000个日常任务,以50个长时段任务为核心赛题,还是全面的具身智能研究资源。
GPT-4o连验证码都解不了??SOTA模型成功率仅40%
MetaAgentX团队推出Open CaptchaWorld平台,用于测试Agent解验证码能力。实测SOTA多模态模型成功率低,如GPT - 4o也被难住。该平台特点多样,揭示了当前Agent短板及模型设计新方向。