后训练范式」共找到 4432 篇相关文章

产品应用7

从需求到研发全自动:如何基于Multi-Agent架构打造AI前端工程师

本文介绍蚂蚁消金前端团队打造的Multi - Agent智能体平台“天工万象”。阐述其技术实践,对比多Agent与统一型Agent、ReAct范式与固定工作流优劣,还介绍专业智能体建设,分享开发中的思考与经验。

阿里云开发者
新闻资讯7

实测GPT-5:写作坠入谷底,编程一骑绝尘。

GPT-5发布,它是统一系统,含多种模型。性能上减少事实幻觉、应对谄媚有进展,跑分强且节能,但无新功能特性。写作不如GPT 4.5,编程表现出色,发布OpenAI与Google预测交叉跳水。

AI大模型应用实践
开源动态8

专为小说、角色扮演等而生:元象开源泛娱乐场景底座模型

元象作为AI与3D技术服务公司,此次开源XVERSE-Ent系列中英双语大模型。它采用MoE热启动技术与三阶段训练策略,解决泛娱乐场景痛点,适配多元语境,有高部署性价比,为行业提供泛娱乐AI解决方案。

AIGC开放社区
新闻资讯8

美光沉迷制造“电子黄金”,不在乎AI泡沫

当地时间12月17日盘,美光2026财年第一财季多项业绩指标超预期,营收和利润大涨。美光不相信“AI泡沫”,其业绩增长源于AI驱动的高带宽内存需求爆发。美光预计HBM市场规模将快速增长,还进行了产品结构优化。

芯师爷
开源动态8

AGI新技术路线:下一代稀疏注意力机制Monte Carlo Attention开源

超对称技术公司开源了 Monte Carlo 注意力机制,用于新版基座模型 BigBang - Proton。它在二进制块编码技术上,用块间代表交流机制实现线性复杂度,解决了传统方法的缺点,可实现理论上无限的上下文长度,对现有预训练技术和硬件设计影响深远。

InfoQ
算法论文8

重写手机AI安全边界!首个MoAI攻防SoK,系统梳理三大安全支柱

墨尔本大学等联合发布论文指出,移动端AI硬件和模型发展使MoAI成重要范式,但带来安全风险。论文给出统一框架,拆解系统为四层,定义三大安全支柱,梳理攻击、防御图谱等,还提出开放问题与未来方向。

新智元
新闻资讯8

世界模型公司「厘清智能」完成数亿元种子轮融资,顺为红杉高瓴齐押注

清华系初创公司「厘清智能」完成数亿元种子轮融资,投资方豪华。其构建世界模型系统,全栈自研,释放强大泛化能力。由97年博导李一鸣领衔,集结名校人才。资本认为其是稀缺的‘范式级’团队。

AI科技评论
新闻资讯7

Claude还是最强,但Anthropic这周好像疯了

Anthropic状告阿里蒸馏模型致其股价创新低。一位87年创业者用AI搭工作流,起初用DeepSeek和Qwen问题多,换Claude流程顺畅。MRCR v2测试显示国产模型与Claude有差距,便宜与省心模型该怎么选成问题。

探索AGI
算法论文8

腾讯混元团队最新研究:让 AI 从「固定模型」走向「实时适配系统」

腾讯混元团队提出论文《HY-WU (Part I)》,尝试让模型在推理阶段根据输入实时动态生成适合任务的参数,而非依赖固定参数。通过多类实验验证,这种方式在图像编辑等任务中有明显优势,还降低了训练复杂度。

AI科技评论
算法论文8

相机参数秒变图片!新模型打通理解生成壁垒,支持任意视角图像创作

S-Lab等机构研究员提出Puffin统一多模态模型,它能整合理解相机参数与按参数生成对应视角图片的能力。通过“用相机思考”和400万组数据训练,解决此前模型问题,还构建相关数据集和评测基准,性能出色。

量子位