「后训练」共找到 3762 篇相关文章
MiniMax都在用!5500PB幕后功臣首次亮相,国产黑马祭出杀招
AI浪潮中,数据流不动致GPU算力空转,XSKY星辰天合举办AIMesh产品战略发布会破局。AIMesh含三网,分别解决IO墙、重力墙、内存墙问题,且开放解耦,获多方认可。
刚刚,Geoffrey Hinton成为第二位引用量破百万的科学家
Geoffrey Hinton成历史上第二位Google Scholar引用量破百万的计算机科学家。介绍其出身、求学、学术成就,他晚年警示AI风险。还提及他两名得意门生Alex Krizhevsky和Ilya Sutskever的情况。
Anthropic 为什么推出 Skills?它会革谁的命!
近期Claude Code出圈,开发者基于其构建应用。Anthropic 作为先驱,在 MCP 后推出 Skills,旨在解决现有技术架构痛点,它是标准化 SOP,有分层设计优势,还推荐了 skill0.atypica.ai 平台。
QCon 北京 2026 启动|Agentic AI 时代的软件工程重塑
QCon北京2026启动,核心主线为「Agentic AI时代的软件工程重塑」。过去大家关注‘AI能做什么’,如今转向其在生产系统的稳定运行等,智能体成新方向,大会将从六维度探索。
跳出「黑盒」,人大刘勇团队最新大语言模型理论与机理综述
大语言模型工程成功但理论研究滞后,被视为「黑盒」。人大刘勇团队用生命周期分类法,将LLM理论研究整合为六阶段,系统综述底层理论与机制,指出前沿挑战,为其向严谨科学转型提供路线图。
比iPhone更疯狂!乔布斯去世15年后,「最像他的人」操刀首款AI硬件
2026年1月,OpenAI首款硬件“Sweetpea”路线图泄露,9月将发布。其形似“蛋石”充电盒内藏耳后设备,搭载顶级芯片,成本高。Jony Ive操刀设计,目标取代iPhone,OpenAI首年计划产销4000 - 5000万台。
李飞飞又被超越了?百万「普通视频」打造通用4D世界模型!
全行业为昂贵多视角数据发愁时,中科院和CreateAI推出NeoVerse,用百万单目视频打开4D世界模型大门。它抛弃多视角数据和离线预处理,解决扩展性瓶颈,在重建速度、生成质量等方面表现出色,有丰富下游应用。
港大联合字节跳动提出JoVA: 一种基于联合自注意力的视频-音频联合生成模型
香港大学联合字节跳动提出视频 - 音频联合生成框架 JoVA,支持音视频 Token 跨模态交互,引入嘴部区域特定损失解决口型同步问题。实验显示,它用约 190 万条数据就达先进水平。
82岁退休的他,带出一系千亿级科技巨头
本文讲述了李国杰带领团队研发超算,创立中科曙光的历程。从“曙光一号”打破国外禁运,到中科曙光在芯片、智算等领域全面发展,虽遭美国制裁仍越打越强,李国杰82岁功成身退。
打工15年,被大厂裁4次了
美国老李15年被微软、Meta、苹果等大厂裁4次。2025年众多科技公司裁员,AI推动岗位变革,企业用懂AI员工换不懂的。失业潮全球都有,有人转型成功,老李最终入职丰田子公司。