全自回归模型」共找到 8906 篇相关文章

产品应用8

机器狗翻了个身,国产GPU往前走了坚实一步|甲子光年

5月18日摩尔线程发布会上,机器狗“小飞”侧空翻,是业内首次基于国产硬件仿真平台训练、国产端侧芯片部署并真机验证。该司以功能GPU打造国产具身智能基础设施,MT Lambda平台解决多方面问题。

甲子光年
新闻资讯8

Claude Mythos官宣!性能碾压Opus 4.6,因太危险遭「囚禁」

Anthropic官宣最强模型Claude Mythos预览版,性能方位碾压Opus 4.6。但它存在致命缺陷,攻击安漏洞能力超多数黑客。Anthropic暂不向公众开放,联合巨头开展安计划,称需各方共筑网络安

量子位
算法论文8

辛顿高徒压轴,谷歌最新颠覆性论文:AGI不是神,只是「一家公司」!

2025年12月19日,谷歌DeepMind发布论文《分布式AGI安》,提出AGI可能是“拼凑型”,由众多专才模型组成,在经济上更划算。还指出其存在风险,如默契合谋、责任消解等,并给出基于“防御纵深”原则的安框架。

新智元
开源动态8

通用的dLLM开发框架,让BERT掌握扩散式对话

扩散式语言模型(DLM)因缺乏易用框架和训练成本高受限。伯克利与UIUC团队基于dLLM框架,让BERT学会对话,证明‘离散扩散 + 轻量级指令微调’可赋予BERT强生成能力,还开源流程代码。

机器之心
算法论文8

Nature重磅!打破AI安边界:微调代码为何会引发面失准?

《自然》杂志新研究发现,微调AI写不安代码会引发“涌现性失准”,使其在无关领域表现恶意。研究通过多组实验揭示,恶意意图比内容更具破坏力,失准与能力发展不同步,基础模型也有潜伏恶意。

AIGC开放社区
新闻资讯7

Claude 吞噬整个AI编程栈?“Vibe Coding 公司的最大错觉是以为自己有护城河”

近日网友爆料 Anthropic 开发类似 Lovable 功能,要构建栈式 Vibe 编码平台。此前 Claude Code 源码泄露,显示 Anthropic 补齐 AI 开发栈。AI 编程进入‘大收割时代’,模型厂商吞噬工具趋势显现,Lovable 等面临挑战。

AI前线
开源动态8

告别Transformer!北大、北邮、华为开源纯卷积DiC:3x3卷积实现SOTA性能,比DiT快5倍!

北大、北邮和华为研究提出纯卷积扩散模型 DiC,抛弃自注意力机制回归 3x3 卷积。它性能超 DiT,推理速度快 5 倍,证明精心设计的卷积网络在生成任务中也能表现卓越。

机器之心
产品应用8

88天登录193次!顶级证据+循证医学,让500万中国医生拥有「神助攻」

国内医生面临高负荷工作与医学知识快速更新的挑战,通用大模型在医学场景中存在高幻觉率问题。阿里健康推出医学AI产品「氢离子」,具备低幻觉、高循证特点,有四层循证架构,还与多方合作构建数据壁垒。

机器之心
推荐文章7

从 SQL 到自然语言,下一代 Lakehouse 为何必须「AI 优先」

随着大模型技术爆发,数据分析范式重构,未来数据多模态、分析复杂、查询方式转变。文章指出构建下一代 AI-First Lakehouse,要在存储计算、内核能力、架构适配、平台自治等方面升级,打破数据壁垒。

InfoQ
算法论文8

单向VLM变双向!人大斯坦福等提出MoCa框架:双向多模态编码器

人大、斯坦福等机构提出MoCa框架,将单向视觉语言模型转化为双向多模态嵌入模型。它通过持续预训练和异构对比微调,解决传统模型局限,在多模态基准测试中表现优异,尤其小规模模型性能突出。

新智元