新能安」共找到 7771 篇相关文章

算法论文8

抗干扰力提升近40% !无需对抗训练,北航上海AI Lab蒸馏方法提升模型鲁棒性 | ICML 2025

在人工智模型规模持续扩大的今天,数据集蒸馏方法提升训练效率、降低成本,但蒸馏模型在全性要求高的任务中抗干扰难。北航上海AI Lab团队提出ROME方法,无需对抗训练,显著提升模型鲁棒性,成果被ICML 2025接收且已开源。

量子位
开源动态8

2张4090竟本地微调万亿参数Kimi K2!趋境联合清华北航把算力门槛击穿了

仅需2 - 4张消费级显卡(4090),就在本地对DeepSeek 671B乃至Kimi K2 1TB这样的超大模型进行微调。这得益于KTransformers和LLaMA - Factory两个国产明星项目联动,大幅降低成本,开启AI个性化定制时代。

量子位
产品应用8

Vidu Q3参考生,这是冲着「剧」来的!万物皆可参考:特效音效场景都备好了

生数科技Vidu Q3发布参考生视频,为剧而生,万物可参。它凭几张图和Prompt生成影视级特效、音效和场景。实测显示其特效、音效、场景表现出色,还解决AI视频创作痛点,兼顾专业与普惠。

量子位
新闻资讯7

智谱 GLM-4.5 团队深夜爆料:上下文要扩、小模型在路上,还承诺尽快发模型!

今日凌晨,GLM系列模型四位研发成员在Reddit的AMA活动中,回答了GLM系列技术细节、未来规划等问题。透露扩展上下文、推小模型是重点,还承诺尽快发模型,也探讨了大模型发展观点。

AI前线
产品应用7

重磅!谷歌开放世界模型Genie 3试用:AI实时生成可玩世界,人人都创造“我的世界”

谷歌开放世界模型Genie 3实验性研究原型Project Genie试用,美国18岁以上Google AI Ultra订阅用户可体验,创建、探索和重混互动世界,不过Genie 3是早期研究模型,有待改进之处。

AI寒武纪
开源动态7

24B模型编程超DeepSeek全家桶,32G内存苹果电脑就跑,专门针对真实GitHub Issue训练

Mistral发布最开源编程模型Devstral,参数24B,在单卡RTX4090甚至32G内存Mac上运行。它专为编程智体推出,针对真实GitHub Issue训练,在SWE - Bench Verified测试中表现出色,还可与All Hands AI框架配合。

量子位
新闻资讯7

All in AI 两年,AI 代码采纳率突破 50%!克创龚银:AI 平台一旦过时,我们会毫不犹豫重构

克创2023年决定All in AI,探索适配内部运营与的产品形态。这两年有项目放弃也有成果,如代码采纳率突破50%。其评估AI落地可行性关注业务、技术、团队成熟度,还采取差异化管理应对创的ROI问题。

InfoQ
算法论文8

最强多模态模型也拿不到30分?DeepImageSearch定义相册搜索范式,开启个人视觉记忆的深度搜索时代

人大窦志成教授团队联合OPPO研究院提出DeepImageSearch图像检索范式,将其从“逐张语义匹配”推向“语料库级上下文推理”。团队构建评测基准DISBench,用ImageSeeker框架评测主流模型,结果显示最强模型单次完美解决查询比例不超三成。

机器之心
算法论文8

AI已迷失方向?强化学习教父Sutton最发布OaK架构,挑战当前AI范式,提出超级智构想

强化学习教父理查德·萨顿认为人工智发展已迷失方向,提出OaK架构回应探寻真正智的需求。该架构是基于模型的强化学习架构,具备组件持续学习等特点,为通用人工智指明路径,但面临持续学习和特征生成挑战。

AI科技大本营
新闻资讯7

商汤王晓刚:世界模型将加快AI从数字空间进入物理世界,「悟」想做那个桥梁

具身智“大脑”成AI竞争焦点,“世界模型”或是通往“类人智”的解法。商汤科技王晓刚认为世界模型将加快AI从数字空间进入物理世界,其推出的“悟”具身智平台想做这个桥梁,还谈到具身智发展面临的问题与挑战。

机器之心