差分蒸馏」共找到 1047 篇相关文章

新闻资讯7

Claude降智实锤了!还变相涨价,Opus跌下神坛

AMD高级总监审计发现Claude处理复杂任务能力变,第三方跑排名下降。官方称调整是为平衡速度与成本,但用户认为是变相降智。此外,企业包月套餐涨价,而Anthropic将推Opus 4.7和新设计工具。

量子位
新闻资讯8

刚刚,神话级Fable 5.1来了!

今天,Claude Fable 5.1全平台上线,Mythos 5.1专供特定团队。新模型跑有断层式代,还降低了算力门槛。通过重绘金星、设计蛋白等案例展示其科研能力,在编程上也表现出色,同时在安全上采取‘一松一紧’策略。

新智元
产品应用8

实测可灵3.0 - 属于每个人的导演时代。

可灵更新至3.0版本,将视频模型能力提升到新高度。它有镜和语言两大升级方向,还升级了Omni模型。可灵3.0适合文生视频等,3.0 Omni擅改视频,二者结合能覆盖多数视频生成场景。

数字生命卡兹克
算法论文8

西交大提出QQWorld:仅需10行代码,世界模型成功率提升5.33个百

2026 年 3 月 Yann LeCun 等人提出 LeWorldModel,西安交通大学研究团队发现其存在问题,进而提出 QQWorld,用位数—位数匹配替换原有的 EP 正则,提升了规划成功率,还提出 Cross - Batch QQ 解决显存问题。

机器之心
开源动态8

刚刚开源就收藏 1000+ 收藏的 DeepSeek Harness 橙皮书,它把Harness拆解个遍!

DeepSeek Harness开源同日,《DeepSeek Harness:从开机到拆开》上线。作者花叔实测记录大量官方文档未写的细节,如完整系统提示词、出厂启动清单等,全书四部,获取方式简单。

开源星探
开源动态7

vLLM 新特性:批量大小不再影响模型输出

vLLM 推出批量不变推理功能,解决大模型推理中相同输入在不同批量大小下结果不同的问题。设置 `VLLM_BATCH_INVARIANT=1` 可保证输出一致,技术实现含三部,虽有性能开销但换来了结果确定性。

AI工程化
新闻资讯7

黄仁勋人生首条推文力挺开源,“Kimi恐慌”成为风暴眼

当地时间7月24日,英伟达创始人黄仁勋发首条推特享联名信力挺开放权重AI。此事与新开源模型Kimi K3引发的‘Kimi恐慌’相关,‘开源vs闭源’路线之争因此推向高潮。同时,围绕模型蒸馏是否侵权争议不断。

DeepTech深科技
开源动态7

我手搓了一个Seedance 2.0镜Skill:一键生成电影级Prompt,再也不用为提示词发愁了

作者为解决用Seedance 2.0写镜提示词难题,手搓Seedance Storyboard Skill。它能引导用户完成镜细节,输出专业提示词。作者实测4种风格案例效果佳,还介绍了Skill原理、安装使用方法。

AI寒武纪
算法论文7

OpenAI和Anthropic费尽心机加密的思维链,竟然能被轻松提取?

围绕大模型蒸馏争议已久,此前外部团队难获闭源模型完整推理。8 月 10 日研究者公开方法,可让弱模型读取旗舰模型密文并输出推理,还发现公开智能体轨迹存在隐私泄露问题,不过未为蒸馏指控提供决定性证据。

DeepTech深科技
新闻资讯8

HiDream-O1-World拿下WBench第一,交互世界模型的格局被改写|甲子光年

近日,智象未来的HiDream - O1 - World模型以平均80.9登顶WBench核心Navi榜,物理一致性维度也排第一。它走出第三条路线,解决时空与物理一致性难题,技术获国际顶会认可,正改变全球竞争格局。

甲子光年