「开放世界智能体」共找到 4395 篇相关文章
《西部世界》开始加载,「斯坦福小镇」团队创业,李飞飞、Karpathy都投了
2023 年爆火的「斯坦福小镇」研究将设想拉进现实。如今其创始团队创立新公司 Simile,获 1 亿美元融资,李飞飞、Andrej Karpathy 等投资。它用 Agent 技术模拟人类行为,探索 LLM 新维度。
世界首个!李飞飞团队推出物理推理基准,大模型统统不及格?
斯坦福联合中科大团队推出世界首个评估视觉语言模型物理推理能力的基准QuantiPhy,通过测试发现顶尖模型在数值计算上不如人类,还揭示模型推理靠记忆而非测量,为AI发展指明方向。
LLM for AIOps:是泡沫还是银弹?智能运维的争议、破局与未来
大模型浪潮下,LLM Agent 在运维领域既被寄予厚望,也饱受争议。「AI 进化论」第六期直播聚焦此话题,阿里云冯富秋和云杉网络向阳从痛点、破局、未来规划解析 LLM 与 OS 协同之道。
AutoDev 3.0 → Xiuper:咻!全平台、全流程智能体编程平台
AutoDev Xiuper 3.0.0-alpha 发布,它是基于 Kotlin Multiplatform 构建的全生命周期 AI 编程助手,覆盖完整开发流程且支持全平台运行。其名 Xiuper 寓意 AI 自然“存在”于开发流程,承载多平台架构新变化。
分钟级定位 IO 瓶颈:多租户云环境下的智能诊断
随着云上规模扩张,多租户云环境下 IO 请求量剧增,IO 问题排查难。阿里云操作系统控制台构建 IO 一键诊断能力,能快速识别问题类型、把握诊断时机、屏蔽复杂关联流程,还介绍了实现原理和案例。
Meta超级智能实验室又发论文,模型混一混,性能直接SOTA
大语言模型训练依赖算力和时间,传统模型 Souping 多采用均匀平均。Meta 等研究者提出类专家 Soup(SoCE),利用基准测试类别构成选最优模型,非均匀加权平均,实验显示其提升了模型效果与稳健性,在排行榜获 SOTA 成绩。
在全球 AI 的惊天变局中,为何越想独立,越要开放?
在科技巨头主导AI风向的当下,人们对数字命运的掌控感到焦虑,催生了主权人工智能概念。《主权人工智能现状》报告揭示,追求AI主权成全球共识,其核心驱动力有四,实现路径是开源,同时也面临挑战。
英伟达说,小语言模型(SLM)是智能体的未来
英伟达论文指出小语言模型(SLM)是代理人工智能未来。SLM参数小于100亿,可装在消费电子设备。英伟达认为其强大、适合代理系统且经济。微软、英伟达等多家厂商的小模型表现出色,文中还分析了SLM优势及代理架构。
OpenAI高管自爆:Scaling不死,GPT-5「双轴训练」撕开智能天花板
OpenAI首席运营官Brad Lightcap在对话中揭秘GPT-5,其能自主判断是否深度推理再作答,体验全面升级。训练方式有后训练,Scaling Law仍成立,未来从两轴改进。还探讨了AGI、应用场景等。
DeepMind让AI当「上帝」,导演一场只有AI演员的「西部世界」
Google DeepMind和多伦多大学研究人员受TTRPG和现代游戏引擎启发,提出Concordia软件库。它基于「实体 - 组件」架构,将工程师与设计师角色分开,能灵活构建多角色生成式AI系统,满足不同需求。