测试时训练」共找到 3967 篇相关文章

开源动态8

微软 SkillOpt:不动模型权重,只训练那份「技能说明书」

微软研究院 Yifan Yang 等人推出 SkillOpt,思路反直觉,不动模型权重,把「技能文档」当可训练参数。它在 52 个组合中表现最优,技能可迁移,代码已开源,还支持多操作。

AI工程化
新闻资讯7

死掉的创业公司,成了AI最抢手的训练数据

过去一年,硅谷倒闭创业公司用数字履历重新估价,卖给AI实验室训练agent。产业链迅速形成,中游有SimpleClosure和Sunset等,下游有多家做RL gym的创业公司,不过该产业链面临隐私等敏感问题。

DeepTech深科技
新闻资讯8

英伟达Jim Fan:「世界建模」是新一代预训练范式

英伟达机器人主管Jim Fan判断,继“下一个词预测”后,世界建模将成新预训练范式,2026年大世界模型将为多模态AI奠基。他还讨论世界模型定义、应用,展望新推理形式,业内人士也各抒己见。

量子位
新闻资讯7

OpenAI与Anthropic罕见合作:竞争对手联手测试AI安全

OpenAI和Anthropic完成联合评估,用内部工具测对方模型并公开结果。测试覆盖指令层级、越狱等四大领域,还发现不少细节和道德困境情况。此次合作意义重大,为行业树立安全合作先例。

AGI Hunt
算法论文8

ICML 2025 | 如何在合成文本数据避免模型崩溃?

随着生成式AI发展,合成数据成大模型训练重要部分,但可能引发“模型崩溃”。ICML 2025会议上,上交大等团队剖析此问题,提出Token - Level Editing策略,避免模型崩溃,实验验证了其有效性。

机器之心
推荐文章8

第二代AI预训练范式:预测下个物理状态

英伟达科学家Jim Fan发布文章《第二代预训练范式》指出,当前以LLM为代表的AI模型基于「对下一词的预测」,在物理世界应用中「水土不服」,第二代范式应是「预测下一个物理状态」,引发机器学习社区讨论。

AINLPer
技术方案7

0 代码改造实现应用运行数据库密码无损轮转

本文探讨通过整合 MSE Nacos、阿里云 KMS 及 Apache Druid 等技术组件,实现应用运行数据库密码无损轮转。介绍敏感数据安全风险,详述方案流程、优势,还提及未来对接更多组件,支持多参数动态更新。

阿里云开发者
新闻资讯7

梅西投了李飞飞,她转身买下了一家机器人“训练场”

足球巨星梅西旗下体育科技投资平台 Play Time 投资了李飞飞的空间智能企业 World Labs。该公司今年 2 月获 10 亿美元融资后收购了 SceniX,以补足其机器人仿真短板。此前,Marble 虽能搭建训练场景,但没掌握物理规律。

InfoQ
算法论文8

清华挖出「幻觉」的罪魁祸首:预训练产生的0.1%神经元

清华大学孙茂松团队从神经元角度研究LLM幻觉微观机制,发现不到0.1%的H - 神经元可预测幻觉,与过度顺从行为相关,根源在预训练阶段,为解决幻觉问题、开发可靠大模型提供新思路。

新智元
新闻资讯6

科技赋能 未来已来 | 人形机器人训练中心探秘 @首钢园

文章探秘首钢园的人形机器人数据训练中心,提及机器人学习的情况,还列出了相关参考资料,展现科技赋能下人形机器人领域的发展。

首钢园