微调加速」共找到 886 篇相关文章

算法论文8

AI 终于学会 「自我坦白」!Anthropic最新论文震撼来袭,「内省适配器」让黑盒模型自己说出隐藏行为

2026年4月28日,Anthropic联合剑桥大学发布论文,提出“内省适配器”技术,可让大模型用自然语言“坦白”微调中学到的行为。该技术在AuditBench基准测试等实战中表现出色,但也存在高误报率等局限。

AI科技评论
产品应用7

我在微信免费养「龙虾」,玩到上瘾,这组CP太强了

2026 开年「龙虾热」渗透各类任务场景,腾讯动作密集。其自研 WorkBuddy 优势明显,与微信 ClawBot 联动成「官配」。经测试,它能高效处理多类任务,还为用户提供权益,腾讯龙虾矩阵加速成形。

机器之心
新闻资讯8

Anthropic CEO Dario Amodei 访谈:我们正在接近指数的终点

Anthropic CEO Dario Amodei 三年前预测基本兑现,此次访谈更放豪言,称 1 - 3 年内有 50% 概率出现“天才之国”,10 年内 90% 确信。访谈覆盖诸多关键问题,如 Scaling 原理、AI 编程生产力、AI 公司盈利模式等。

宝玉AI
算法论文8

2026开年关键词:Self-Distillation,大模型真正走向「持续学习」

2026年刚开场,Self - Distillation成大模型领域高频词汇。传统强教师依赖范式难适配大模型持续进化,MIT等顶尖机构发布三项成果,用不同方法实现自蒸馏,推动模型持续学习。

机器之心
新闻资讯8

魔法原子迎来“春晚时刻”|甲子光年

2026年,魔法原子成春晚智能机器人战略合作伙伴,还举办全球合作伙伴大会。其自研机器人挑战春晚复杂环境,此前全栈自研积累实力,有超亿元订单,靠场景和生态赋能突围,未来需转化技术优势为商业成功。

甲子光年
新闻资讯8

“AI 工程师”已上岗!微软 CEO 曝正尝试新学徒制模式:内部工程师的顶级实践全变

在达沃斯论坛上,微软 CEO 萨蒂亚·纳德拉与英国前首相聚焦 AI 应用话题。他以自身参会准备工作变化,说明 AI 打破传统层级架构。还指出企业 AI 应用有‘杠杆效应’,人才差距在应用推进力度,判断泡沫关键在于落地。

AI前线
产品应用8

老黄挤爆牙膏!DLSS 4.5狂飙6倍,RTX 50系直接封神

2026年CES大会上,英伟达发布DLSS 4.5提升画质与帧生成,RTX Remix助力经典游戏重生,还将NPC变智能伙伴。同时,其软件升级利好AI PC,提升性能、减少显存消耗,让它更接近日常使用。

新智元
推荐文章8

DeepSeek V3到V3.2的进化之路,一文看全

知名AI研究者Sebastian Raschka发布深度博客,详细梳理DeepSeek V3到V3.2进化历程。DeepSeek V3.2性能对标GPT - 5和Gemini 3.0 Pro,且为开放权重模型,报告涵盖众多有趣领域和知识。

机器之心
开源动态7

在 Cache-DiT 框架下实现原生 Serving功能

Cache-DiT 是唯品会开源的 PyTorch 原生 DiT 推理加速引擎,此前聚焦离线推理。现实现完整 Serving 功能,支持单卡与分布式推理模式。文章介绍其实现过程、借鉴 SGLang 的设计,还总结踩坑及使用方法。

GiantPandaLLM
开源动态7

Voices 能够让 Java 应用程序快速实现文本到语音转换

Voices 是开源文本转语音项目,为 Java 17 及以上应用设计,无需外部 API 或手动安装软件。可按字典或 OpenVoice 为不同语言生成音频,其使用 ONNX Runtime 加速,还介绍了使用方法和配置。

InfoQ