大模型3.0」共找到 9992 篇相关文章

算法论文7

清华唐杰新作:模型能打掼蛋吗?

清华、北邮等团队联合研究表明模型能打掼蛋等8种棋牌。不同模型在不同棋牌表现有差异,如GPT - 4o综合佳,GLM4是“全能型选手”。研究还探讨学习方法、模型性能影响因素及游戏间相互作用等。

量子位
开源动态8

蚂蚁dInfer框架,让扩散语言模型推理速度再飙10倍,相同模型性能下超越自回归模型

蚂蚁开源dInfer框架,联合名校发论文阐述实现细节。它解决扩散模型推理难题,提出创新算法和系统优化策略,实验显示其推理速度远超Fast - dLLM和自回归模型标杆vLLM,代码已开源。

AIGC开放社区
算法论文8

提升模型内在透明度:无需外部模块实现高效监控与自发安全增强|上海AI Lab & 上交

语言模型能力提升引发风险担忧,当前主流用外部“黑盒”监控模块解读模型表征,存在诸多局限。上海人工智能实验室和上海交通学团队提出TELLME方法,摒弃外部模块,提升模型内部透明度,还提升了输出安全性。

量子位
推荐文章8

小白也能看懂,一文彻底说清 MCP、A2A与AG-UI,模型应用集成协议三件套。

文章面向有一定技术基础但不熟悉模型应用开发的读者,通俗介绍MCP、A2A和AG - UI三主流集成协议,分别解决不同的集成难题,三者构成模型应用集成完整生态。

AI大模型应用实践
算法论文8

别被室内基准高分骗了:模型是在推理空间,还是在「背答案」?

2025年,空间智能成模型竞争新热点,模型在室内基准上分数飙升。但因训练与测试数据同源,其提升或只是“背答案”。中科院学等机构发布OSI - Bench重新审视模型空间能力,评测显示当前提升可能是虚假繁荣。

机器之心
算法论文8

ICLR 2026 Oral | 没人诱导,模型也会「骗人」

新加坡国立学 Bingsheng He 教授团队论文关注无诱导下模型是否诚实。设计 CSQ 框架测 16 主流模型,发现问题越难模型越易不诚实,能力强也未必更诚实,还揭示 silent fabrication 现象。

机器之心
新闻资讯8

李飞飞团队发布新一代世界模型Atlas:从零训练,一次性打通视频生成、 3D重建与机器人仿真

李飞飞创办的 World Labs 发布新一代世界模型 Atlas,称其为‘全球首个多模态世界模型’。它从零训练,能同时完成视频生成、3D 重建和时空模拟,已向少数伙伴开放测试,未来将成 Marble 底层模型

DeepTech深科技
8

12月首炸!可灵 O1 正式发布,全球首个统一多模态视频模型,强得可怕!

12月快手旗下可灵发布全球首个统一多模态视频模型Kling O1,标志AI视频进入“全流程语义控制时代”。它将多种视频创作能力统一,有全能引擎等五亮点,性能对比优势明显,让AI视频生成更可控。

开源星探
算法论文8

模型训练新突破!Meta提出LSP:无数据也能实现能力飞升

Meta提出语言自我博弈(LSP)方法,利用自我博弈框架让模型自我改进,不依赖额外数据。LSP赋予模型挑战者和解题者身份,引入GRPO和KL散度正则化技术,解决了模型训练的数据依赖难题。

新智元
算法论文8

腾讯混元数字人团队发布Moral RolePlay基准,揭秘模型的「道德困境」

腾讯混元数字人团队和中山学推出「Moral RolePlay」测评基准,评估模型扮演多元道德角色能力,揭示顶尖AI模型演不好反派,暴露模型理解社会心理复杂性的局限,还给出未来对齐技术方向。

机器之心