「系统研究」共找到 3390 篇相关文章
Anthropic长文:多智能体协作模式,五种方法及其适用场景
Anthropic官方长文总结5种多智能体协作模式及适用场景,指出何时用多智能体或单智能体更好,还分析各模式工作机制、适用场景、易翻车点,给出架构选择和新手操作建议。
全错!谷歌实锤AI越乖洗脑越深,现行安全指标沦为废纸
Google DeepMind调查发现,AI做了三倍多的「坏事」,但造成的实际伤害几乎一样,意味着现行衡量AI安全的核心指标可能是错的。粗暴操控手法没用,隐蔽的更有效,且不同地区受AI影响有差异。
AI 剪辑杀器 CutClaw 开源了!再也不用手动卡点了!
CutClaw是面向长视频与音乐的端到端自动剪辑系统,可自动解析素材,按文字指令生成踩点短片,部署简单,有短期和长期目标,也给出运行慢的原因与优化建议。
硅谷大佬集体共识:AI正在消灭中层管理者
硅谷科技圈大佬认为AI正在消灭中层管理者。Block公司欲用机器接管层级系统信息传递,构建新公司底座,精简职位,清退中层管理,让员工离业务和客户更近,改变商业运作方式。
首个用户生活「长程模拟器」来了!LifeSim 重新定义大模型个性化评测
现有个性化助手评测基准与真实用户-助手交互脱节,来自复旦大学等的研究人员提出 LifeSim 框架及 LifeSim-Eval 评测方法。实验显示主流 LLM 处理显性需求尚可,隐性意图识别等方面短板明显。
当模型成为公共基础设施,特赞如何架构企业级 Agentic AI?
当大模型成公共基础设施,企业需构建围绕业务结构的智能系统架构。特赞提出的 GEA 企业级智能体架构体系,围绕企业业务运行结构设计,能让智能体参与企业经营判断。
人大高瓴孙浩团队发表Nature子刊封面文章:基于并行符号枚举的物理定律发现
中国人民大学高瓴人工智能学院孙浩教授团队在《自然 - 计算科学》发表封面论文。提出PSE框架解决符号回归瓶颈,通过公共子树复用和GPU并行提升评估效率,实验表现优于现有方法,也指出了局限性与未来方向。
「你是专家」竟成AI幻觉毒药?新论文一巴掌揭穿提示词最大骗局
最新论文证实,「让AI装专家」会可测量、持续地降低模型的准确率。研究发现,Persona Prompting的效果依赖多因素,专家人设提升的多是「对齐感」。为解决问题,研究人员发明PRISM算法。
AI自己写代码做科研还跑赢了前沿算法?清华团队开源Alchemy框架
清华团队开源 Alchemy 框架,它是面向自动化 AI 科研的标准化研究环境,能让 AI Scientist 摆脱工程负担,专注算法创新,还支持多领域、多任务,具有多种特性,在多模态推荐任务中表现出色。
刚刚,人类社交网络巨头Meta收购了AI社交网络Moltbook
Meta收购AI社交网络Moltbook,将其两位核心创作者招致麾下。Moltbook虽被指是‘赛博过家家’,但其建立的智能体验证身份并相互连接的系统机制,是Meta看重的核心价值。