后训练范式」共找到 4428 篇相关文章

开源动态8

终于用上啦,3.9 万 Star archify,程序员福音!!!!

架构图常与代码脱节,约3.9万Star的archify让Agent先把代码库或系统描述写成带类型的JSON,经布局、检查交付可交互系统地图,它先结构化、验证再交付,适用于特定场景。

小华同学ai
推荐文章7

智谱公布“降智”的秘密:Scaling不可避免的痛

智谱最新技术博客大倒苦水,称从GLM - 5以来遭遇「Scaling Pain」。团队排查出高负载下推理状态管理等问题致异常,还给出避坑指南,如在线异常监控策略,优化系统更稳定,吞吐量提升。

量子位
开源动态8

击败 GPT-5!理想汽车开源 RubricHub:大模型开放生成从此有了专业裁判

理想汽车基座模型团队联合高校发布RubricHub数据集,解决开放式任务评价难题。该数据集可将主观评价转化为量化标准,经其训练的Qwen3 - 14B小模型在医疗基准测试中超越GPT - 5。

AI科技评论
新闻资讯8

马斯克xAI又融了200亿美元!老黄说到做到投了更多

刚开年,马斯克的xAI完成E轮融资,达200亿美元超预期。英伟达和思科等继续支持,其估值预计从500亿涨至2000多亿。还公布《xAI 2025年终总结》,Grok 5正在训练,传闻一季度推出。

量子位
新闻资讯8

医生版 ChatGPT 3 年估值 60 亿美金,被低估的 AI 硬件新玩法:相框

OpenEvidence被称为医学领域的Google和医生版ChatGPT,成立3年估值达60亿美金。它用高质量数据训练小而专模型,有“无幻觉”机制,直接面向医生推广,产品进化为临床决策助手,收入来自制药广告。

投资实习所
8

从6人日到1人日:一次AI驱动的客户端需求开发实战

文章分享AI驱动客户端需求开发实战,从实践活动汇总AI Coding问题,给出解决建议。以穿搭动态框架需求为例展示开发过程,对比效率提升300%,还探讨需求拆分、Prompt编写等问题,介绍业务开发范式

阿里云开发者
推荐文章8

高性能计算群星闪耀时

文章介绍高性能计算(HPC)对大模型的重要性,回顾中国HPC发展历程,讲述清华高性能所郑纬民等学者贡献,还提及团队在大模型训练、推理、存储等方面成果,以及类脑计算等新探索。

AI科技评论
算法论文8

ICCV 2025 | SeaS: 工业异常生成+正常合成+精准掩码大一统框架,指标全面碾压SOTA

华中科技大学慢工团队提出少样本工业生成模型SeaS,依托U-Net,只需1 - 3张训练样本,单模型同步实现多样异常生成、正常产品合成及精确异常掩码标注,突破现有方法局限,在主流数据集上超越SOTA。

机器之心
新闻资讯7

刚刚,ARC-AGI-3发布!人类100分,最强AI零分

ARC Prize发布ARC - AGI - 3预览版,测试范式从静态谜题到交互式游戏。新引入交互式推理基准测试,人类轻松通关,最强AI却全军覆没。但测试引发社区质疑,奖金设置也遭吐槽,且存在体验和技术问题。

AGI Hunt
推荐文章7

诺基亚坟墓里,埋着半套战胜美国的密码本

文章回顾诺基亚兴衰史,从濒临破产到成为全球手机霸主,被苹果等超越。其崛起得益于市场机制、人才红利等;失败因利益分配失衡致盟友倒戈。这对中美科技竞争有启示,重塑利益格局很关键。

芯师爷