多模型攻击」共找到 9699 篇相关文章

算法论文7

英伟达说,小语言模型(SLM)是智能体的未来

英伟达论文指出小语言模型(SLM)是代理人工智能未来。SLM参数小于100亿,可装在消费电子设备。英伟达认为其强大、适合代理系统且经济。微软、英伟达等家厂商的小模型表现出色,文中还分析了SLM优势及代理架构。

AI与安全
产品应用8

文心新出的推理大模型,给了我们信心

在 WAVE SUMMIT 2025 大会上,百度发布文心大模型 X1.1,是 X1 升级版,发布即上线可免费体验。它在事实性、指令遵循、智能体等能力显著提升,全方位测评表现出色,还开源新模型,展现百度全栈 AI 实力。

机器之心
产品应用8

融合风控知识的大模型体系建设与应用实践

腾讯算法专家欧阳天雄在AICon大会分享《大模型驱动下的智能风控落地实践》,介绍腾讯天御融合海量风控知识构建金融风控大模型,解决传统风控模型难题,还展示构建技术、工程实践及落地案例,为金融风控提供新思路。

InfoQ
开源动态8

6.5k星!轻量级智能体对话编排框架Agent Squad

Agent Squad是轻量级智能体对话编排框架,有6.5k星。它能管理AI代理、处理复杂对话,具智能意图分类等特性。新SupervisorAgent可协调专业代理,还有演示应用及种使用示例。

GitHubStore
算法论文8

MIT新研究:大模型加噪声就能替代GRPO/PPO调参

MIT新论文提出,预训练模型周围存在大量“专家模型”,只需添加高斯噪声并集成,性能就能比肩甚至超越GRPO/PPO等调参算法。由此启发了RandOpt算法,经测试准确率不错,但也有依赖预训练等缺点。

量子位
算法论文8

视频模型也能推理,Sora2推理能力超过GPT-5

DeepWisdom团队研究发现视频生成模型能推理,在空间类任务上比图文模型更擅长。团队推出VR - Bench基准测试,构建客观评分体系。实验显示视频模型在空间推理有优势,相关代码和数据集已开源。

量子位
算法论文8

告别数据「噪音」,UCSD大模型推理新方法DreamPRM充当「信号放大器」,登顶MathVista测评榜

DreamPRM由加州大学圣地亚哥分校团队开发,在MathVista测评榜夺冠。它通过双层优化框架解决模态过程奖励模型训练难题,能与模态大模型集成,提升推理能力,实验效果显著。

机器之心
算法论文7

视频模型假装在推理?MME-CoF新基准评估12个推理维度

视频生成模型如Veo - 3能生成逼真视频,但推理能力存疑。香港中文大学等校研究者设计12项测试,发现模型只能模仿表面模式,未真正理解因果。研究推出MME - CoF基准,为评估指明方向。

新智元
开源动态7

3 天上了两个 SOTA 模型,视频 Agent 们接得过来吗?

7月31日MiniMax H3和字节跳动Seedance 2.5同日发布,3天后H3开源,8月7日Seedance 2.5开放api。模型变强使产品层要做的事更,视频Agent需解决生产问题,竞争走向模型层之上。

Founder Park
新闻资讯7

马斯克都惊呼太强!阿里Qwen3.5又一波端侧小模型发布

上周阿里发布Qwen3.5中等规模超强模型,现又推出端侧小模型,获马斯克称赞。其智能密度翻倍且原生模态,各型号有Base版。不同参数模型性能出色,阿里布局完整生态链,开启智能化未来。

AIGC开放社区