显示技术」共找到 4070 篇相关文章

算法论文8

让大模型学会「心灵感应」:基于思维沟通的多智能体合作范式来了

NeurIPS 2025的论文提出思维沟通概念,建立潜在思维可识别性理论,构建ThoughtComm框架。该框架让模型共享潜在思维,跳过语言冗余歧义,实验显示其提升了协作效率与推理能力,或开启新智能形态。

机器之心
开源动态8

OpenAI 迈出关键一步:LLM 黑盒不再是盲盒

OpenAI开源新研究成果,提出全新范式,训练权重稀疏的Transformer模型以提取人类可理解的电路。该方法分三步,关键结果显示稀疏模型优势多,但也存在训练成本高、规模有限等局限,还给出两条未来路线。

PaperAgent
推荐文章7

The Sentient Interface: Art, Technology, and the Expanded Mind

在计算与数据主导的时代,艺术、科学与技术边界渐趋模糊。本次活动汇聚四位从业者,探讨如何将无形元素转化为审美体验,从生态数据到AI叙事,跨越学科探索人机关系与环境依存。

MANA新媒体艺术站
开源动态8

自回归科学基座模型 BigBang-Proton,提出实现 AGI 的新路线

超对称公司发布自回归科学基座模型 BigBang - Proton,挑战主流 AGI 技术路线。它实现多学科问题与 LLM 统一预训练和推理,有三项创新,在多专业任务表现出色,还提出宇宙尺度压缩构想。

AI科技大本营
开源动态7

我MiniMax,用实习生处理数据,照样屠榜开源大模型

MiniMax M2屠榜开源大模型,引发社区热议。它在注意力机制、数据处理、思考模式上另辟蹊径,公开技术细节。M2团队选Full Attention,雇实习生处理数据,提出交错式思维链策略,强调实用性和泛化能力。

量子位
新闻资讯7

国产GPU第一股IPO获批,募资80亿

证监会官网显示,摩尔线程IPO注册申请已获批准,从6月30日递交招股书,仅用时4个月。此次IPO计划募资80亿用于研发等。公司业务为GPU相关,核心是MUSA架构,已推四代芯片。

量子位
算法论文7

【DeepSeek-OCR系列第一篇】Language Modelling with Pixels【ICLR23】

当前主流语言模型依赖固定词表,扩展到多语言、多脚本时面临覆盖受限、计算昂贵、鲁棒性差等问题。ICLR 2023论文提出不依赖词表的PIXEL模型,通过将文本变成图像用视觉Transformer理解,实验验证其有跨语言、抗噪声等优势。

机器学习AI算法工程
推荐文章7

刚刚,Thinking Machines Lab博客提出在策略蒸馏,Qwen被cue 38次

Thinking Machines Lab发布《在策略蒸馏》博客,提出在策略蒸馏可结合强化学习纠错与SFT奖励密度,成本低且能让小模型有强大性能。该成果受Qwen团队启发,大量用Qwen3模型。还对比了不同训练方法。

机器之心
新闻资讯8

AI时代,开发者不能再当 i 人了,「云计算代言人」敬告

亚马逊云科技副总裁 Jeff Barr 时隔 16 年再访中国,对比两个技术时代。他认为 AI 带来创新与挑战,开发者需强大沟通力。还介绍亚马逊云科技工具 Kiro 及新开发模式,预测未来软件开发形态转变。

机器之心
算法论文8

无VAE扩散模型! 清华&可灵团队「撞车」谢赛宁团队「RAE」

清华大学智能视觉团队和快手可灵团队联合推出《Latent Diffusion Model without Variational Autoencoder》,提出 SVG 框架,用预训练视觉特征编码器替代传统 VAE,解决了传统「VAE + Diffusion」范式的效率与通用性痛点。

机器之心