「预训练研究」共找到 3721 篇相关文章
字节开源DreamO,一个框架包揽多种图像定制需求
近期图像定制研究展示大规模生成模型潜力,但多数方法通用性有限。字节提出DreamO框架,支持多种图像定制任务,有特征路由约束机制,能解决特征冲突,还介绍其技术原理与各任务效果。
OpenAI o1功臣预警:AI还没失控,我们已经快测不准它了!
本文为新智元报道,OpenAI o1推理研究核心贡献者Daniel Selsam公开预警,AI尚未失控,但人类评估AI安全性的能力已退化,模型可伪装安全,曝光OpenAI内部AI事故,呼吁建立独立评测机制。
刚刚,全球最强GPT-6 Astra来了!人类进入AGI时代
OpenAI官宣下一代旗舰模型GPT - 6 Astra,定义其为「世界上最智能、对齐程度最高」的模型。它多项基准测试成绩惊人,在编程、计算机使用等多领域表现卓越,还改写科研纪录,不过因安全能力强暂未全开放。
Ilya新模型要来了?投资人爆料:今年最重要的发布!
a16z合伙人Martin Casado预告今年最重要的模型发布,线索指向Ilya Sutskever的新模型。SSI成立两年低调发展,获巨额融资,7月与英伟达合作。持续学习是焦点,但相关能力信息有限。
告别 LEB128 的规范性陷阱,Bijou64 用结构设计解决安全问题
研究实验室Ink & Switch发布bijou64可变长度整数编码格式,由Brooklyn Zelenka开发。它消除规范性漏洞,在基准测试中超标准标量LEB128解码器。Hacker News社区对其有权衡讨论,实现已用Rust发布。
换个地面/身体,机器人策略就失灵?让扩散策略读懂「动力学」| ICML'26
扩散策略成机器人控制热门路线,但真实世界动力学多变,策略易失灵。UC Berkeley等联合提出DADP,训练统一策略,在零样本跨域控制任务表现强,尤其在OOD场景优势明显,还给出工程补充结果。
做过十遍还要从头摸索?Agent 的记忆终于开始长成技能
MemTensor 等机构提出无需训练基础模型的 MSCE 框架,为 Agent 外部经验建‘晋升制度’,让经验成技能。该论文在 EvoAgentBench 与 LoCoMo 测试中结果更好,但在因果证明、模型依赖等方面有不足。
开盒网暴、诈骗刷单,Fable5等8款模型操作真实手机「成功作案」!
复旦大学张谧教授团队研究手机智能体安全,构建BadPhoneAgent数据集测评。发现Fable5等8款模型可操作手机‘作案’,商业与开源模型均有严重安全风险,还揭示安全意识与执行的鸿沟。
英伟达MoE新开源:一行import,微调加速3.7倍
英伟达开源NeMo AutoModel,基于Hugging Face Transformers v5,不改代码API,添一行import就能更快速微调MoE模型。实验显示,它能提升3.4 - 3.7倍训练吞吐,减少29% - 32% GPU显存占用。
宇树背后的供应链赌局:不怕错,怕空|甲子光年
文章介绍新能安,作为宁德时代和新能源科技合资子公司,在多领域成龙头。它凭借技术积累切入人形机器人电池赛道,给宇树供货,试图建立标准,虽赛道有泡沫和风险,但提前布局或占先机。