后训练流程」共找到 4410 篇相关文章

算法论文8

扎克伯格的豪赌初见成效?Meta新方法让LLM长上下文处理提速30倍

Meta Superintelligence Labs提出REFRAG高效解码框架,解决LLM长上下文输入效率瓶颈。它通过四步流程优化解码,让首个token生成时间加速达30.8倍,扩展上下文,且精度不降反升,不过价值待实际检验。

机器之心
推荐文章8

OpenAI 最新报告:让团队变得 AI Native 的五大原则

OpenAI 发布白皮书《Staying ahead in the age of AI》,基于与国际大公司合作经验,提炼出让团队变得 AI Native 的五大原则,即对齐、激活、放大、加速、治理,还给出各原则策略及反思问题。

特工宇宙
产品应用7

Claude Code凭什么牛?大模型团队天天用自家产品,发现bug直接就改了

Claude Code虽有争议,但很成功,4个月用户达11.5万。Claude Code负责人透露构建细节,如产品理念、评估标准、反馈机制等,还阐述编程领域变化、模型与工具共同进化等内容。

机器之心
新闻资讯7

招聘最猛的竟不是OpenAI!这家陷入间谍案的HR初创,正在狂招工程师

自2022年11月ChatGPT推出,美国技术岗变化大。虽裁员潮缓解但新增岗位有限,竞争激烈。资深职位主导招聘,AI工程师需求旺,旧金山湾区优势明显,大厂任职年限拉长,远程岗位比例下降。

新智元
新闻资讯8

中国AI芯片大突围,DeepSeek V3.1引爆算力革命

DeepSeek V3.1发布,是中国AI技术自主性的战略突围。它有6850亿参数,采用UE8M0 FP8适配国产芯片,具混合推理架构、Agent能力等。其发布或重塑AI产业格局,推动国产芯片发展。

AIGC开放社区
开源动态8

轻量级易开发,8B参数释放大实力!科学多模态模型Intern-S1-mini开源

上海人工智能实验室继7月26日开源,推出轻量化版本Intern-S1-mini。它是8B参数“迷你模型”,兼具通用与专业科学能力,适合快速部署和二次开发,在多方面表现出色,还降低了对高端计算设备依赖。

OpenMMLab
新闻资讯7

机器人也会「摸鱼」了?宇树G1赛葛优瘫刷美女视频,网友:比人还懂享受生活

宇树G1机器人在2025世界人形机器人运动会夺冠,赛“葛优瘫”刷视频的画面走红。此次运动会上,宇树机器人成绩亮眼,不过也出现“肇事逃逸”等小插曲,技术在进步中也暴露一些问题。

机器之心
开源动态7

狂涨12.6K star!Shell命令即搞定可视化监控,超级6~~

开源君分享简单轻量的开源项目Sampler,它能通过YAML配置文件实现系统指标监控与可视化,支持多平台,收获12.6K star。其有简单易用、跨平台等特色,安装创建配置文件即可使用。

开源先锋
开源动态8

字节开源终身记忆多模态智能体,长时记忆+RL,实测超Gemini‑GPT4o!

字节开源全球首个带终身记忆更新的全多模态智能体M3 - Agent,给其装上‘长期记忆’大脑。它构建实体记忆图谱解决现有Agent问题,架构含两个流程,代码实现有特色,跑分数据出色。

探索AGI
产品应用8

理解、生成、编辑一次搞定:Skywork UniPic 2.0的统一多模态解法|甲子光年

电商团队常面临创作流程繁琐问题,当前行业需统一架构。昆仑万维发布Skywork UniPic 2.0,整合理解、生成、编辑功能。它参数小性能优,还构建奖励模型,配合其他模型构建体系,具成本等优势。

甲子光年