多粒度理解」共找到 4690 篇相关文章

推荐文章7

中学生就能看懂:从零开始理解LLM内部原理【十二】|位置嵌入 - 给模型装上"GPS"

文章指出Transformer对词顺序不敏感,引出位置嵌入概念。介绍经典的函数编码、可学习位置嵌入法及新主流RoPE,还提及为让模型处理长文本,在RoPE基础上用PI和YaRN等扩窗技巧。

AI大模型应用实践
算法论文8

让大模型学会「心灵感应」:基于思维沟通的智能体合作范式来了

NeurIPS 2025的论文提出思维沟通概念,建立潜在思维可识别性理论,构建ThoughtComm框架。该框架让模型共享潜在思维,跳过语言冗余歧义,实验显示其提升了协作效率与推理能力,或开启新智能形态。

机器之心
产品应用7

了一个哄孩子AI神器,一张破涂鸦竟能秒变迪士尼动画

年轻父母有了哄娃新法子,用AI可将涂鸦变动画。博主用Midjourney将妈妈30年前涂鸦做成动画,还给出提示词框架。介绍即梦、可灵、谷歌Veo3等工具,它们能快速生成音视频,各有优劣。还提到Meta的Animated Drawings玩法。

机器之心
算法论文8

全球首个人形机器人通用视觉感知系统,Humanoid Occupancy建立模态环境理解新范式

北京人形机器人创新中心推出 Humanoid Occupancy 感知系统,创新性融合模态传感器信息,构建通用感知框架。它以语义占用表征为核心,有全编码和适配融合优势,经实验验证性能优,推动机器人迈向通用感知时代。

机器之心
算法论文8

免剪辑直出!AI生成角色同框对话视频,动态路由精准绑定音频

Bind-Your-Avatar基于扩散Transformer框架,通过细粒度嵌入路由将语音与角色绑定,实现精准音画同步,还引入数据集MTCC和基准测试,实验显示其在身份保真和音画同步上优于现有方法。

新智元
算法论文8

田渊栋:连续思维链效率更高,可同时编码个路径,“叠加态”式并行搜索

AI大牛田渊栋团队利用连续空间“叠加态”让大模型并行推理,提升图可达性等任务表现,为连续思维链提供理论支持。还设计注意力选择器等机制,实验显示连续思维链模型准确率更高。此外,田渊栋还是科幻小说家。

量子位
推荐文章7

中学生就能看懂:从零开始理解LLM内部原理【九】| 层归一化:神经网络的稳定器

本文是系列文章第九篇,介绍了神经网络中的层归一化。先回顾标准差、标准分概念,指出其可使差异可控稳定。接着说明层归一化将原思想用在神经网络,还加入可学习参数,最后总结其作用与应用位置。

AI大模型应用实践
算法论文7

700个「坏模型」喂出AI测谎仪?Anthropic审计神器让AI自曝黑料

Anthropic故意训练近700个「有问题」模型,训了LoRA适配器(IA)让模型自报家门。IA在AuditBench平均成功率59%,但也存在幻觉、成本高、训练分布无指南等局限。

新智元
算法论文7

DeepSeek-R1推理智能从哪儿来?谷歌新研究:模型内心个角色吵翻了

过去两年大模型推理能力跃迁,谷歌等机构研究指出,推理能力提升源于模型推理时隐式模拟类智能体交互结构“思维社会”,还提出利用“群体智慧”新方向,并介绍了研究方法、实验结果等。

AINLPer
算法论文7

DeepSeek-R1推理智能从哪儿来?谷歌新研究:模型内心个角色吵翻了

谷歌等机构研究指出,推理模型能力提升源于‘思维社会’,即模拟类智能体交互结构。如 DeepSeek - R1 等在推理中展现高视角样性,对话特征能提升推理准确率,还提出利用‘群体智慧’新方向。

机器之心