「善意的混乱」共找到 10646 篇相关文章
黑马图像模型被Nano Banana技术负责人点赞!15人华人小队,DDIM之父&CVPR最佳论文作者带队
Luma AI推出全新图像模型Uni - 1,对标谷歌Nano Banana Pro和GPT Image 1.5。它是统一图像理解与生成模型,多项评测表现出色。背后是不到15人的华人团队,由DDIM之父和CVPR最佳论文作者带队。
OpenAI将上任新部门CEO,发表深度长文
Instacart首席执行官Fidji Simo将在8月18日加入OpenAI任新部门CEO,她发文阐述AI赋能人类的看法,指出要确保技术为更多人带来机遇,还详述AI在知识、健康等方面改变生活的潜力。
强化学习+大模型记忆:Mem-α,让智能体第一次学会“如何记忆”
在大语言模型发展中,‘记忆’是智能体具备长期智能的关键。现有外部记忆系统有局限,Mem-α将强化学习引入大模型记忆管理体系,解决记忆难题,在性能、泛化等多方面表现出色。
重磅!DeepSeek R1论文经过同行评议登上Nature封面,梁文锋作为通讯作者再次创造历史
DeepSeek R1论文《DeepSeek - R1 incentivizes reasoning in LLMs through reinforcement learning》登上Nature封面,梁文锋为通讯作者。它是首个经同行评议的有全球影响力的LLM,训练成本低,创新使用‘纯粹强化学习’方法,启发众多研究。
突发!Grok4官宣免费,马斯克背刺付费用户也要卷GPT-5。
毫无征兆地,马斯克将刚发布不久的Grok4免费放开,此前使用需付30刀。可能因销量不佳,加上GPT - 5发布带来压力。这引发付费用户不满,也有人提出使用Heavy模型的建议。
Snowflake 落地中国两年:迈向智能体企业时代,关键在上下文
本文是Snowflake入华两周年之际,在首次中国站Snowflake World Tour发布企业智能体战略的深度报道,核心提出企业AI落地关键在业务上下文,给出可落地的智能体企业架构,分享多家企业落地实践。
装上这个Skill后,Claude Code联网能力直接拉满
Web Access 是给 Claude Code 用的 Skill,装上后 Agent 联网能力大幅提升。它解决了 Claude Code 原有联网工具的问题,有联网工具自动选择、CDP 浏览器操作等能力,还介绍了安装方式和设计哲学。
The Batch:927|极速扩散学习
研究表明扩散图像生成器学习重建预训练编码器嵌入可加快训练,Apple团队提出的FAE,通过缩小嵌入再重建解决了因嵌入尺寸大导致的训练受阻问题,性能与先进模型相当且训练更快。
突发!Anthropic “封杀”中国控股公司,禁止其使用Claude等AI服务
9月5日,Anthropic公司宣布禁止多数股权由中国资本持有的集团或其子公司使用Claude,政策调整涉及“直接或间接由中国实体控制(占股比例超过50%)”的企业,也适用于俄、伊、朝等国。
刚刚,Anthropic新作:大模型意识被发现了
Anthropic 最新研究发现 LLM 有可被语言化报告的全局工作空间(J - space),用 Jacobian Lens 技术能读出模型思考概念、干预推理,还可暴露其未说出口的意图,为 AI 安全审计提供新途径。