训练场」共找到 2425 篇相关文章

开源动态8

英伟达MoE新开源:一行import,微调加速3.7倍

英伟达开源NeMo AutoModel,基于Hugging Face Transformers v5,不改代码API,添一行import就能更快速微调MoE模型。实验显示,它能提升3.4 - 3.7倍训练吞吐,减少29% - 32% GPU显存占用。

量子位
产品应用7

Kimi Work 推出目标模式:连肝 24 小时做了本漫画书,已开源

Kimi Work 推出目标模式,设定完成条件可自动工作至达标。与 Claude Code、Codex 有差异,还具 Agent 集群能力。作者用其复刻 Logo、转换论文格式、制作漫画书并开源,指出目标模式类似模型训练

AGI Hunt
算法论文8

Karpathy加入Anthropic要做的事,被Google提前做了

Karpathy官宣加入Anthropic要组建新团队‘用Claude加速预训练研究’,话音未落,Google&Meta等发论文‘LLMs Improving LLMs’验证了该思路。论文让Claude Code搜索最优推理策略,结果全面超越人类设计。

PaperAgent
开源动态8

几张GPU干翻超算!耶鲁AI颠覆化学合成,实验成功率71%

近日,耶鲁大学李昊特团队开发 AI 系统 MOSAIC,将化学合成知识分 2498 个领域训练专家模型。测试中对超 35 种新化合物合成成功率达 71%,还完成难反应与新反应,相关论文发表于《自然》。

DeepTech深科技
算法论文8

“这个怎么组装?”一句无害的问题,如何让AI产生危险输出

Amazon团队发现全新威胁模型“视觉排他性”,提出MM - Plan框架,通过强化学习训练智能体自动发现攻击策略。实验显示其对Claude 4.5 Sonnet和GPT - 5攻击成功率可观,代码和数据集已开源。

深度学习自然语言处理
新闻资讯8

哈佛《Science》研究:大模型已碾压人类医生!

哈佛医学院等团队让OpenAI o1系列大模型与数百位医生在多项测试中较量,大模型在各项诊断和管理推理任务上全面超越人类专家,不过当下模型处理非文本信号有局限。

AIGC开放社区
算法论文8

脸谱心智陆弘远团队ACL 2026新作:别再给模型叠加「高级词」了!模型更爱听「大白话」

脸谱心智与香港中文大学科研人员中稿 ACL 2026 的新工作提出 Adam’s Law,即文本频率定律,揭示文本频率对模型训练及推理的重要性,还给出工程解法,实验效果显著,为行业带来新思路。

机器之心
新闻资讯8

斯坦福423页AI报告出炉!中美差距仅2.7%,清华DeepSeek冲进全球前十

斯坦福发布「2026年AI指数报告」,长达423页,揭示全球AI产业版图。指出中美AI模型性能差距仅2.7%,AI发展迅速但人类管控能力未跟上,还呈现出就业、算力、应用等多方面趋势。

新智元
新闻资讯7

当AI进入物理世界:西门子科技大会要回答一个关键问题 | 甲子光年

2026年3月23 - 24日西门子将在北京举办科技大会,将系统呈现AI进入现实工业系统后的技术结构,探讨AI融入生产体系问题。大会还将举行多活动,众多企业领袖将参与对谈。

甲子光年
新闻资讯7

理解了巴菲特“补票”谷歌,就理解了字节、阿里与腾讯的AI入口大战

2026年初,字节、阿里、腾讯围绕AI入口与生态展开争夺。从巴菲特卖苹果买谷歌案例可理解这大战,谷歌建成AI全栈生态,其他科技巨头布局时各有挑战,AI时代建立生态才能不败。

芯师爷