论文成果」共找到 1660 篇相关文章

算法论文8

内存直降50%,token需求少56%!用视觉方式处理长文本

在NeurIPS 2025论文中,南京理工大学等校研究团队提出VIST框架,为大语言模型长文本高效推理提供视觉解决方案。它模仿人类阅读机制,让模型具备选择性阅读能力,减少Token需求和内存使用。

新智元
开源动态7

只要强化学习1/10成本!翁荔的Thinking Machines盯上了Qwen的黑科技

新智元报道,翁荔的Thinking Machines研究同策略蒸馏策略,能以1/10强化学习成本,结合同策略训练优势与密集奖励信号。该策略受DAGGER启发,扩展Qwen3团队工作,可在Tinker复现,还能用于个性化和持续学习。

新智元
开源动态8

如何在24GB显存里,塞下一个万亿参数的巨兽?KTransformers入选顶会SOSP

清华大学与趋境科技联合研发的KTransformers系统,可让消费级显卡跑万亿级参数模型,其论文入选SOSP 2025。该系统解决MoE模型本地部署难题,技术创新多,还与SGLang合作,提升硬件利用率。

AIGC开放社区
新闻资讯7

Karpathy 评 DeepSeek-OCR:分词器必须消失!马斯克:光子才是 AI 的终极语言

Andrej Karpathy 发长文讨论 DeepSeek - OCR 论文,提出图像输入比文本更高效,还表达对分词器的厌恶,认为其必须消失。马斯克称 AI 主要交互将是视觉。开发者分享实践经验,也有人提出质疑。

AGI Hunt
新闻资讯8

讯飞刚发的财报:净利润暴涨了202%

科大讯飞2025年第三季度财报亮眼,营收、利润、现金流全面转正,归母净利润同比大增202%。AI大模型技术突破与产业化落地成业绩修复关键,在技术、业务、生态方面成效显著,还将加大研发投入。

量子位
开源动态8

文本已死,视觉当立!Karpathy狂赞DeepSeek新模型,终结分词器时代

DeepSeek新成果DeepSeek - OCR以像素处理文本,压缩率小于1/10,基准测试领跑,开源一夜获4.4k星。Karpathy力挺,认为应赶走分词器,展望视觉成通用输入前景,马斯克有更科幻猜想。

新智元
产品应用7

屏下光谱颜色传感技术:开启环境智能感知的新纪元

智能机流行带来蓝光伤眼问题,手机屏幕技术变革,引入屏下光谱传感。艾迈斯欧司朗举办论坛分享成果,其开发的OLED屏下光谱颜色传感器,能精准重构XYZ响应,解决行业难题,获多方认可。

芯师爷
算法论文8

视觉领域的GPT-3时刻!DeepMind首次证明Veo3模型实现对物理世界建模和推理

谷歌DeepMind研究团队论文显示,视频模型Veo 3学会‘无师自通’,能处理多种没学过的视觉任务。研究人员将其能力分四级,还做了定量评估。研究认为机器视觉或正处范式转变边缘。

AIGC开放社区
算法论文8

CMU&斯坦福提出Reasoning新范式!自己找“窍门”,教会LLM抽象Reasoning

大型语言模型解决复杂推理问题时效率低,论文提出创新方法,让模型利用“推理抽象”,通过RLAD两玩家强化学习框架训练,在多基准测试提升性能,还分析了其作用、局限与未来方向。

深度学习自然语言处理
推荐文章7

AI优质信息源整理:高质量网站、博主与Twitter资源推荐

文章整理了AI优质信息源,介绍Twitter在AI浪潮中的重要性及筛选优质信息流方法,还列举知乎、B站等平台,以及资讯平台、网站、播客、博客等资源,给出挑选标准和了解领域的技巧。

AI Reading Hub