「DMD2算法」共找到 2404 篇相关文章
用SFT打出RL的效果?微软联合提出高效后训练算法
大模型后训练阶段,SFT 和 RL 各有优劣。微软等联合提出新工作,量化 SFT 和 RL 在数据层面的差距,提出 IDFT 和 Hinted Decoding 等高效后训练技术,实验显示新方法泛化超 SFT、效率超 RL。
太初元碁乔梁:AI算法已经跑到单芯片极限|MEET2026
在量子位MEET2026智能未来大会上,太初元碁乔梁表示,当下AI算力需求指数级增长,超智融合成行业共识。单颗芯片性能成瓶颈,太初元碁设计PC link实现芯片互联,还分享了HPC+AI在多领域的落地实践。
2.4万亿参数原生全模态,文心5.0一手实测来了
文心5.0正式发布,主打原生全模态,支持全模态输入和输出。官方测试显示其多维度表现突出,在LMArena文本排行榜并列全球第二。实测其理解精细、能捕捉细节,技术上采用自回归统一结构和超大规模混合专家架构。
零一万物高管新阵容亮相,李开复加码布局ToB 2.0
零一万物ToB战略加速落地,公布新一轮高管任命,沈鹏飞、赵斌强、宁宁三位核心管理者亮相。其“一把手工程”依托万智平台,已覆盖多行业,在国内外均有合作成果,目标是让AI成企业转型推动者。
DeepSeek V3.1更新「最终版」!下一次是V4/R2了???
DeepSeek-V3.1更新至DeepSeek-V3.1-Terminus版本,修复了“极你太美”等bug,缓解中英文混杂等情况,优化了Code Agent与Search Agent表现。评测显示输出更稳定,但编程竞赛分数下降引质疑,版本名引发对后续版本猜测。
SRO架构赋予Qwen-2.5-VL推理能力,性能飙升16.8%
文本领域推理模型成就大,但扩展到多模态大语言模型遇阻力,如冷启动初始化不足等。为此提出 SRO 三阶段训练框架,经测试,ReVisual - R1 平均性能提升 16.8 个百分点。
AI让文科彻底灭绝?算法猜不透人心,人类终将反杀!
著名科技记者Steven Levy给文科生打强心剂,认为无论AI多强大,它没人性,人文学科涉及对人类行为与创造力的理解,是计算机无法获得的,文科生仍有广阔未来。
新站上线一周,一天从谷歌获取2.85万点击是什么体验。
新网站上线后,如何快速获得谷歌的曝光和点击?哥飞和良辰美通过新词新站理论,实现了网站流量的大幅提升。但排名波动和曝光点击数的差异,背后的原因究竟是什么?
新站上线一周,一天从谷歌获取2.85万点击是什么体验。
新站上线后如何快速获得谷歌流量?哥飞与良辰美的网站案例或许能给你答案。
DeepSeek陈德里开发自动研究Skill,写一篇论文人类只动脑2小时
DeepSeek研究员陈德里用自己开发的技能DeliAutoResearch等完成研究综述论文。论文提出自动研究智能体L1–L5自主度分类体系,对比四大架构模式,分析17个主流系统,还提出六大开放问题。