大模型智能体」共找到 10668 篇相关文章

开源动态8

世界模型混战,蚂蚁炸出开源牌

蚂蚁集团旗下蚂蚁灵波发布并开源通用世界模型 LingBot-World,全面开源代码和权重,不绑定硬件或平台。它在多维度有突破,虽有细节瑕疵,但单次生成近 10 分钟连贯视频或刷新纪录,还在 VBench 测试领先。

AI前线
新闻资讯8

突发!反噬来了,英伟达限制使用 Anthropic 模型

本文爆料突发AI行业事件:Anthropic发布新模型后推出强制数据留存政策,推翻此前和企业签订的零数据保留协议,引发数据安全担忧,英伟达等三家巨头率先限制使用其模型

AI寒武纪
算法论文9

Meta新研究:字节模型蒸馏后,天花板破了

本文介绍Meta FAIR与华盛顿学合作的最新研究,针对传统模型蒸馏Token候选空间、存储成本高的痛点,提出字节级蒸馏方案,验证其可突破Token天花板提升模型能力上限。

量子位
产品应用8

Google Gemini Embedding2:一个模型处理所有媒体类型

Google发布Gemini Embedding 2,首个原生多模态嵌入模型。能处理文本、图像等多种媒体类型,支持交错输入,覆盖超100种语言。与多模型串联方案比,延迟降70%、召回率升20%。已可在Gemini API等使用。

AI工程化
开源动态8

字节会师何恺明!开源连续扩散语言模型Cola DLM

字节会师何恺明,开源连续扩散语言模型Cola DLM,释出论文、代码等。该模型跳出离散token束缚,把生成过程交给连续空间,在实验中展现出稳定scaling趋势,其动机是表征而非diffusion。

量子位
算法论文8

智能体并非越多越好,45%准确率成关键拐点

Google研究《Towards a Science of Scaling Agent Systems》验证“智能体并非越多越好”。在GPT等上实验发现,单个智能体准确率超45%,增加数量会损性能,还揭示工具税、错误螺旋等问题,给出预测公式。

AI工程化
新闻资讯7

Anthropic 断供,国产 Coding 模型的中场战事开启

Anthropic对中国企业断供,国产模型面临成为Claude平替的机遇。Kimi等模型纷纷尝试,Kimi K2 0905版本在编码、上下文及工具调用上提升,其终极目标或构建具Agent特质产品,未来Agent是决胜场。

Founder Park
产品应用8

长文本推理 5 倍提速!面壁MiniCPM4 端侧模型发布,0.5B模型效果秒杀同级

近日,面壁发布 MiniCPM4.0 端侧模型,有 8B、0.5B 两种规模。其在基准测试表现出色,长文本推理提速,缓存锐减,还做了架构创新。此外,面壁有自研推理框架,科学化建模产线,6 月 27 - 28 日 AICon 北京站将探讨 AI 趋势。

AI前线
开源动态8

Meta开源首个320亿参数代码世界模型CWM

Meta FAIR发布320亿参数的研究模型Code World Model (CWM),用“世界模拟”方式处理代码,试图真正“理解”代码逻辑。它在Math - 500数据集测试成绩亮眼,模型权重开放,可多渠道下载。

AI工程化
产品应用7

世界模型的新用途:不做选手,去当裁判

眼下具身赛道都在抢着做机器人的“脑”,而地瓜机器人发布的世界模型Uranus却剑走偏锋,做机器人开发的基础设施。它能更客观地评测VLA和世界模型,还能做机器人训练的“场地”。

量子位