后训练课程」共找到 3818 篇相关文章

开源动态8

Z-Image标准版开源:更具可塑性的图像生成全能基座

Z-Image标准版开源,它是为开发者准备的强大画板,解决了生成模型同质化问题。其保留完整权重,在微调、风格化上潜力大,采用创新架构,训练定位SFT阶段,有完整CFG支持,还提供完善工具链。

AIGC开放社区
开源动态7

小模型也能精确计算:WorldModel-Qwen的推理时代码执行实验

开发者bigattichouse让Qwen - 0.6B小模型推理时生成并执行WASM代码获计算结果。最初尝试加标签生成Python代码效率低,用WASM,创建三层架构。虽结果未完美,但接近,还通过Gemini审查验证。

AI工程化
开源动态8

蚂蚁C2LLM:基于注意力池化的代码检索新范式

在Code RAG场景中,传统文本Embedding模型处理代码表现欠佳。蚂蚁集团与上海交通大学联合发布C2LLM系列模型,引入注意池化模块,在MTEB - Code榜单表现出色,还得益于优质训练流程,成果已回馈社区。

PaperAgent
新闻资讯7

网民票选AI王者,LMArena一夜变17亿美元独角兽!

LMArena原是校园开源小项目,从2023年起步,如今估值达17亿美元。其Arena模式让网友盲投选AI,Elo评分系统算排名。虽有众包投票易操纵等争议,但已成行业标杆,还将为大厂提供付费评估服务。

新智元
新闻资讯8

老黄All in物理AI!最新GPU性能5倍提升,还砸掉了智驾门槛

英伟达CEO黄仁勋在CES 2026发布AI新品,全力搞AI。推出下一代Rubin架构GPU,性能大幅提升;发布五大领域成果,含新模型家族、平台等;还开源训练框架与多模态数据集,国产开源模型被提及。

量子位
算法论文8

上交大 × 华为小艺推出LoPA:7B扩散语言模型单样例1000+ tokens/s!

上海交通大学DENG Lab联合华为小艺团队提出无需训练的解码算法LoPA,配合自研的LoPA - Dist分布式推理系统,显著提升扩散大语言模型(dLLMs)的推理并行度和吞吐量,将推理效率推向新高度。

深度学习自然语言处理
开源动态8

RDSAI-CLI - 用AI重塑数据库终端CLI体验

阿里云RDS团队在发布「RDS AI助手」,推出智能终端工具RDSAI-CLI。它融合大语言模型能力,将数据库命令行操作升级为意图式交互。该工具已开源,有基础与高级功能,未来还会持续优化。

阿里云开发者
产品应用8

用了飞书aily新功能,我终于理解什么叫“AI不是聊天,是干活”

作者黄叔体验飞书 aily 工作助手的“任务模式”赞不绝口。该模式能异步工作、深度结合飞书生态,可像数字员工一样交付多种成果,如竞品报告、网页、海报、播客等,虽有不足但非常实用。

AI产品黄叔
算法论文7

港中文 MMlab×美团新研究:仅用一个模型,应对多种视觉推理任务

港中文 MMLab 与美团联合提出 OneThinker 多模态统一推理模型,将多种视觉任务抽象为‘先推理、作答’形式,通过多任务强化学习优化。实验显示其在多任务表现佳,为通用视觉推理模型提供参考。

AI科技评论
产品应用7

我用Cursor测了下GPT-5.2,好像并不是那么回事儿~

GPT-5.2发布,奥特曼称其很强。作者用Cursor在真实Coding场景对GPT-5.2和Gemini 3 pro做测试,涉及烟花盛宴、5000篇Paper分析、RAG代码重构,结果显示GPT-5.2在多方面表现欠佳,写代码需慎重。

PaperAgent