「后训练方法」共找到 4825 篇相关文章
陈立武的无限战争
本文讲述陈立武在半导体领域的辉煌成就,他曾执掌楷登电子,华登国际投资超100家半导体企业。他出任英特尔CEO后虽带来投资,但因推动收购自家孵化企业引发信任危机,不过长期看其地位或难动摇。
不装了!LeCun哈萨比斯神仙吵架,马斯克也站队了
图灵奖得主Yann LeCun与诺贝尔奖得主、谷歌DeepMind CEO哈萨比斯就“智能的本质”展开激辩,马斯克站队哈萨比斯。二人观点分歧大,后LeCun称主要是用词分歧,双方都关注世界模型,但理解和实践有别。
来了,DeepSeek又悄悄开源LPLB项目
DeepSeek 悄悄开源 LPLB 项目,该项目解决 MoE 小批量训练专家每批 token 数抖动问题。LPLB 在 EPLB 基础上,将‘冗余专家’看成带容量边的图,每批解一次线性规划,实现 token 重新路由,单节点 100µs 级求解。
重新思考RLVR中的熵正则:从探索不足到探索过度的破局之路
2024年以来,RLVR使大模型在推理任务有显著突破,但实践中探索机制易失衡。传统熵正则化在LRM场景易走向极端,研究团队提出SIREN方法精准调控探索,实验显示其在多模型和数据集上性能提升显著。
Meta「透视」AI思维链:CRV推理诊断,准确率达 92%!
Meta FAIR团队在论文中提出CRV方法,可实时观察AI思维过程。它通过改造模型大脑结构,让推理可见。在算术推理实验中,检测精度提升到92.47%,还能让模型修正错误。不过该技术落地尚面临诸多挑战。
统计学和机器学到底有什么区别?
文章探讨统计学和机器学习的区别,指出两者目的不同,统计模型重推断关系,机器学习重预测。以线性回归为例说明差异,还澄清常见误解,表明机器学习基于统计学但涉及多领域,最后称选方法要看目标。
360开源高质量图文对齐数据集!收纳1200万张图像+1000万组细粒度负样本,让模型告别“图文不符”
360人工智能研究团队的冷大炜博士团队开源FineHARD高质量图文对齐数据集,包含1200万张图像、4000万个边界框及对应描述、1000万组细粒度难负样本,能提升模型图文对齐能力,还介绍了构建方法、分析及应用前景。
大模型热度退潮,真正的技术创新者开始被「看见」
过去两年中国大模型投资多是商业模式驱动,而技术投资注重创新。DeepSeek 出圈后,独立创新成主流。今年国内大模型吸金热度下降,但智谱 AI、面壁智能仍获融资。面壁智能发布 MiniCPM 4.0,在多方面优化,展现端侧优势。
构建 AI 时代的知识底座:直播数据 LLM Wiki 实践
文章围绕直播数据 LLM Wiki 实践展开,指出领域知识沉淀面临挑战,引出 LLM Wiki。介绍其实际效果,如指标召回、代码生成等,阐述构建方法、架构设计、编译流水线、检索方式,还提及增量编译与持续 Lint,最后给出未来规划。
中国黑马狂赚3亿美金!国内AI应用断层第一,估值20亿美金
演语科技完成近3亿美元B+轮融资,投后估值超20亿美元。其ARR超3亿,构建起业务闭环。旗下LibTV、LiblibAI和星流表现出色,创始人陈冕布局生态,演语已成全球第一梯队玩家。