「训练引擎」共找到 2457 篇相关文章
当 Token 成为商品,AI 基础设施会怎么变化?
在大模型时代,智能生产和交付未实现工业化,存在性能鸿沟。九章云极提出AI工厂战略,发布Alaya NeW Cloud 3.0,将从资源计量转向智能计量,打造训练和Token工厂,提升算力到有效Token的转化效率。
全能高手&科学明星,上海AI实验室开源发布『书生』科学多模态大模型Intern-S1 | WAIC 2025
7月26日,上海AI实验室在WAIC 2025上发布并开源科学多模态大模型Intern-S1。它融合多学科知识,首创跨模态科学解析引擎,在多学科任务上超越顶尖闭源模型,还支撑构建了多智能体系统。
伯克利斯坦福联手造出「科研预言家」:77%准确率押注研究想法前景
伯克利和斯坦福团队让GPT - 4.1变身「科研预言家」,从顶会提取想法对比案例训练,不借助实验验证,靠推理押注。其在公开题库测试、人类专家团战等测试中表现出色,还能预测AI新点子。
突发!卡帕西官宣加入Anthropic,OpenAI对家挤满了前员工
安德烈·卡帕西宣布加入 Anthropic,负责 Claude 模型大规模训练。他是知名 AI 研究者,曾任职 OpenAI、特斯拉等。此前 AI 人才争夺 Meta 和 OpenAI 是主角,Anthropic 闷声吸纳了卡帕西,OpenAI 联合创始团队成员多有流失。
GPT-5系列咋都爱说「哥布林」?原因找到了
OpenAI发布博客解释模型迷上「哥布林」的原因。原来是训练“Nerdy”人格时,奖励信号偏爱怪物词汇,强化学习将风格固化并扩散到普通对话。此前DeepSeek V3.1也出现过「极」字Bug。
成立半年连续获数千万融资,智子芯元凭什么卡位国产算力生态?|甲子光年
智子芯元成立半年获数千万天使轮融资。国产AI算力生态面临适配难题,该公司用“AI+运筹”解决。其核心技术“运筹学x大模型”,自研KernelCAT引擎,实现多场景高效交付,具泛化性。
60秒极限挑战!中国GPU独角兽杀出重围,斩获图形顶会大奖
2025年12月,SIGGRAPH Asia 2025在香港开幕,摩尔线程在3DGS重建挑战赛中凭自研技术LiteGS斩获银奖。该团队还开源3DGS基础库LiteGS,实现全链路协同优化,提升训练效率与重建质量。
实测完豆包Seedream 4.5,替我设计师朋友哭了
火山引擎推出图像创作模型Doubao - Seedream - 4.5,有强化原图保持、多图组合生成、优化海报排版与Logo设计等主打点。经实测效果不错,已全量开放API并公测,官方还给出生图tips。
高性能全闪并行文件系统的设计和实践
焱融科技 CTO 张文涛在 QCon 大会分享‘高性能全闪并行文件系统的设计和实践’,介绍了焱融全闪文件存储架构和 YRCloudFile 技术细节,分享其解决 AI 训练存储难题的方案。
Anthropic逃过一劫:成功和解万亿美元版权诉讼,避免破产
Anthropic与作者达成和解,避开12月审判和可能高达万亿的赔偿。此前法官裁定其用盗版内容训练模型属盗版行为。和解为行业划红线,数据需明确来源授权,Anthropic仍面临其他版权挑战。