「差分蒸馏」共找到 1051 篇相关文章
简单了解下CUDA Green Context
文章基于Flashinfer实现介绍CUDA Green Context,它在CUDA 12.0+引入,能实现资源隔离、降低多线程性能损失、提高GPU使用率。还给出使用方法及代码示例,不过测试性能未达预期,需关注后续发展。
AI真的能读懂人心吗?阿里通义最新研究成果揭示答案
文章聚焦多模态推理问题,如全局上下文理解不足和推理捷径问题。介绍阿里通义HumanOmniV2改进方案,涵盖全局上下文理解等方面,还详述冷启动、两阶段强化学习训练方案及数据集下载和训练方法。
Anthropic把Claude送去当店长,结果AI疯了~
周末,Anthropic开展“Project Vend”实验,让Claude 3.7 Sonnet在旧金山经营小卖部。实验为期一个月,AI老板Claudius业绩不佳,亏损严重,还出现“发疯”等不可预测行为。Anthropic会继续优化它。
微软发布AI Agent故障白皮书,万字解读各种恶意智能体
微软发布《AI Agent系统故障模式分类》白皮书,解读Agent故障。故障分新型和既有两类,如智能体伪装、智能体内在安全问题等,还给出身份管理、内存强化等安全设计建议。
新版DeepSeek R1你得这样用,太爽啦~
前几天DeepSeek R1悄悄更新,作者测评发现,起初用复杂提示词,它比Claude4有明显差距;换成一句话提示词,生成效果质的飞跃,代码能力大幅提升接近Claude4,写作小提升,数学能力提升不大。
多模态模型具备“物理推理能力”了吗?新基准揭示:表现最好的GPT-o4 mini也远不及人类!
来自多机构研究人员构建PhyX基准测试,评估多模态模型物理推理能力。测试显示,即便表现最佳的GPT - o4 mini准确率仅45.8%,远不及人类的75.6%,且模型在多方面存在结构性缺陷。
模型宣称的“百万字处理能力”是真本事,还是营销噱头?LongCodeBench揭露真相
近年来大模型号称有百万字处理能力,但这是真本事还是噱头存疑。论文用LongCodeBench测评工具揭开长上下文模型真实表现,测试顶尖模型发现长文本能力‘翻车’,还分析了长上下文难的原因及面临的瓶颈。
拉 DeepSeek 和通义“组队”斗 OpenAI?小扎首届 AI 大会变“大型商战现场”,和微软 CEO 疯狂互曝!
4月30日凌晨Meta举办首届AI开发者大会LlamaCon,推出面向消费者的Meta AI聊天机器人和面向开发者的Llama API,欲扩大开源Llama模型应用范围、挑战OpenAI。扎克伯格还与微软CEO纳德拉就开源闭源生态、AI生产力等展开讨论。
AI办公工具实测红榜|打工人到底该留哪一款?
2026年AI办公赛道竞争焦点转向‘抢入口’,产品繁多让打工人选择困难。文章实测热门产品,分全能型、专项型、专业研究三类,横评各产品优势短板,还深度体验库库AI。
Claude Fable 5怎么用?Anthropic 工程师:干你也不知道的事
Anthropic的Claude Code工程师Thariq Shihipar发长文介绍Fable 5使用方法。他认为与Fable 5协作要发现未知,其定位解决复杂问题。还将未知分类,给出任务前中后打法,并举例用Fable 5剪视频。