「后训练方案」共找到 4409 篇相关文章
直面LeCun愿景,智在无界发布最强具身世界模型,20万小时人类视频屠榜6大榜单
智在无界作为人类视频学习路线开创者,4月14日发布第三代旗舰模型Being - H0.7,用20万小时人类视频训练,提出新范式,在6项权威评测中综合排名全球第一,拓展了世界模型能力边界。
大模型学会拖进度条看视频了!阿里新研究让视频推理告别脑补,实现证据链思考 | ICLR 2026
阿里巴巴未来生活实验室团队解决多模态大模型视频推理难题,推出ReWatch数据集和ReWatch - R1模型。数据集克服现有训练数据痛点,模型用SFT + RL范式及创新奖励机制,实验成绩SOTA。
有什么事情是当了程序员之后才知道的?
本文是腾讯程序员分享当程序员后才知道的事,如改一行代码能崩项目、本地部署模型可免费搞定等,还给出多个有趣观点,最后发起评论互动并抽取粉丝送Q币卡。
濒死3次,医生判他死刑!宾大教授奇迹自救,誓用AI攻克14000种绝症
宾大教授David Fajgenbaum多次濒死自救成功,创立Every Cure,借助AI系统MATRIX在7500万种药病组合中找治疗方案,已帮多名患者,还计划公开预测结果,用AI+人类模式助力医学。
拆解腾讯智能体战略:自身验证,开放能力,生态放大 | 甲子光年
文章指出智能体成企业战略议题,但落地有场景复杂、知识专业和工程化挑战。腾讯云以全栈方案应对,用开发平台、行业适配和生态共建助力企业,多个行业已有成功落地案例。
好奇心之旅:Cursor代码库索引机制的学习笔记
作者作为高德信息工程团队AI先锋队一员,日常用Cursor开发,因好奇其代码库索引机制展开探索。介绍了Cursor索引工作流程、隐私安全等,还研究Merkle树、turbopuffer向量库及开源方案Continue。
DeepSeek-R1发布100天后:全面复盘推理大模型复现研究及未来!
推理语言模型(RLMs)发展显著,DeepSeek - R1发布引发广泛影响且未完全开源。MiroMind等总结其复现研究,关注SFT和RLVR方向,介绍数据构建、方法设计、训练过程细节及实验关键发现。
静态稀疏已死:Flux Attention 开启长文本 LLM 自适应推理新时代
文章指出长上下文LLM高效推理面临性能与效率难题,先介绍Elastic Attention打破静态稀疏桎梏,后重点阐述全新的Flux Attention,它将动态稀疏注意力范式升级为层级别路由,解决了算法与硬件的矛盾,在多方面实现突破。
手撕Sora,脚踢Veo!13个行业实战案例,Seedance 2.0玩法大全
本文是藏师傅对 Seedance 2.0 的测评和教学,介绍其 API 春节后将上线火山引擎,支持全模态输入。通过 13 个行业实战案例展示该模型能力,如生成广告、宣传片、教学视频等,还提及 Agent 自动化应用。
准确率提升至 90%,阿里商旅基于 AgentScope 构建多智能体差旅助手最佳实践
阿里商旅依托阿里巴巴生态,旗下AliGo差旅助手可实现业务闭环。早期单智能体模式有瓶颈,后基于AgentScope构建多智能体系统,从技术选型、架构设计等多方面优化,事项收集准确率提至90%+,还解决诸多问题并获奖。