上下文去噪训练」共找到 2905 篇相关文章

算法论文8

揭示扩散语言模型扩展定律,人大高瓴团队与蚂蚁集团发布LLaDA MoE v2

中国人民大学高瓴人工智能学院与蚂蚁集团合作,首次系统刻画混合专家扩散语言模型扩展定律,据此训练LLaDA MoE v2,实现扩展效率与智能双重突破,将推动其迈向规模化时代。

机器之心
产品应用8

天选Windows打工AI来了!实测完Claude Cowork国产版:超顶

硅谷Claude Cowork出圈后,国产昆仑万维Skywork桌面版登场。它支持模型自由切换、海量Skills集成,实测任务完成率高、速度快、有自纠错机制,依托上下文能力升级,是国产AI创新力量的展示。

量子位
开源动态8

一个超级搜索Agent开源,超低成本拉满搜索推理能力!小参数、慢思考。

MiroThinker 1.5发布,打响2026年AI模型进步第一枪。它以小参数实现高性能,解决信息雾霾、AI幻觉、决策无力等问题,通过交互式扩展和时序敏感训练沙盒技术,展现强大搜索推理能力。

开源AI项目落地
新闻资讯7

你聊得很开心的AI女友,背后却是被当做耗材的肯尼亚小伙们。

肯尼亚小伙迈克尔应聘工作后,成了伪装AI的陪聊员。工作严苛,还得忍受不适内容。公司借此收集数据训练算法,他越努力就越快被替代,成了AI时代的‘耗材’。

数字生命卡兹克
开源动态8

香港中科院发布聆音大模型,400万张图喂出个“AI超声神医”

中国科学院香港创新研究院发布超声大模型“聆音”,用超400万张图像的超声数据集,经自监督学习训练。它在多项诊断任务破纪录,临床效果佳,还将模型等开源,有望推动领域发展。

AIGC开放社区
算法论文8

OpenAI罕见发论文:我们找到了AI幻觉的罪魁祸首

AI“幻觉”是阻碍完全信任AI的关键障碍,目前无根治良方。OpenAI罕见发论文揭示其根源,指出标准训练和评估程序奖励猜测,应加大对自信错误的惩罚,奖励表达不确定性。

机器之心
开源动态8

小米模型实现声音理解新SOTA!数据吞吐效率暴增20倍,推理速度快4倍 | 全量开源

小米全量开源MiDashengLM - 7B模型,它基于Xiaomi Dasheng和Qwen2.5 - Omni - 7B Thinker,实现声音理解新SOTA。性能领先,推理效率高,革新训练范式,全栈开源,将赋能多场景。

量子位
新闻资讯7

登上热搜!Prompt不再是AI重点,新热点是Context Engineering

最近「上下文工程」很火,Andrej Karpathy 为其打 Call。它和「提示词工程」不同,是构建自动化系统给模型提供输入。文章介绍了其核心要素、实践方法论,还给出了参考的博客和视频。

机器之心
推荐文章7

别再构建多智能体了

Multi Agent应用有望成大模型应用范式,但Cognition AI团队认为2025年追求多智能体并行协作架构是歧途,存在信息孤岛和决策冲突问题。主张采用单线程线性架构与上下文工程。

AI工程化
产品应用8

华为版《黑客帝国》首次亮相:训推复杂AI前先“彩排”,小时级预演万卡集群

华为首次亮相数字化风洞虚拟环境平台,可在训推复杂AI模型前“彩排”,小时级预演万卡集群。其包含Sim2Train、Sim2Infer、Sim2Availability,分别解决训练、推理、高可用问题。

量子位