「训练技术」共找到 4608 篇相关文章
ICML 2025 | 如何在合成文本数据时避免模型崩溃?
随着生成式AI发展,合成数据成大模型训练重要部分,但可能引发“模型崩溃”。ICML 2025会议上,上交大等团队剖析此问题,提出Token - Level Editing策略,避免模型崩溃,实验验证了其有效性。
登上Science Robotics顶刊!清华团队耗时22年,终于教会机器人踢足球
今年8月,清华赵明国教授团队联合字节跳动Seed等在《Science Robotics》发表论文,提出视觉驱动的反应式足球技能学习框架。该研究历经22年技术接力,成果在真机和赛事中验证,加速进化平台助力研究。
刚刚,百度文心又拿第一了!完全免费
百度文心助手不到二十天拿下国内、全球两个‘第一’。SuperCLUE最新XClaw测评中文心获97.62最高分,此前7月20日在权威PinchBench v2榜单也问鼎世界第一。且该产品免费不限量,其底层能力源于百度搜索技术。
为什么今天造大模型的人,一半在学物理
文章指出在AI前沿,不少定义方向的人出身物理。物理训练赋予的品味与做AI的方法论高度重合,体现在统计力学与神经网络、对普适规律的信仰等方面,还提到Scaling Laws最能体现这种品味。
谷歌深夜双发!最便宜Nano Banana来了
谷歌深夜上线Nano Banana 2 Lite和Gemini Omni Flash。前者是最快最便宜文生图模型,4秒生图且成本低;后者是视频生成模型,支持多模态输入和对话式编辑。二者串联打通创作流水线,还集成SynthID水印技术。
arXiv变天:将脱离康奈尔大学独立,招聘CEO,网友:以后还能白嫖吗?
arXiv发布官方信息,将脱离康奈尔大学转型为独立非营利组织,还发布CEO招聘公告。它始建于1991年,在康奈尔经历从个人项目到机构基础设施的转型,现面临AI投稿井喷、审核困境和技术债务等挑战。
蚂蚁集团扩散大语言模型新突破:超800Token/s,速度与质量兼得
蚂蚁集团将LLaDA更新到2.1,通过引入“草稿 - 编辑”机制,打破扩散模型推理速度与质量的对立僵局。它有极速和质量两种模式,还采用混合训练流程及强化学习,在多基准测试中表现出色。
蚂蚁具身智能明牌了:做大脑,和宇树们错位竞争
蚂蚁灵波开源具身智能基座模型LingBot-VLA,用20000小时真实世界数据训练,解锁最大规模开源真机数据之一。它性能超国际顶尖模型,还指明通用具身智能发展路径,为行业提供全栈解决方案。
AI招聘逆天研究:看照片预测一生职业成就
硅谷大厂HR标配的AI招聘系统Eightfold AI被指控算法歧视,求职者要求提高招聘筛选透明度。同时,美国多所高校研究者完成一项研究,AI能通过人脸照片预测职业走向,但因训练数据问题引发公平性争议。
核心团队被谷歌挖角后,Cognition 宣布收购 Windsurf 剩余团队
今日凌晨,29岁华人IOI金牌创始人Scott Wu官宣Cognition AI收购Windsurf。此前谷歌以24亿美元收购其核心团队。虽部分人员出走,但Windsurf产品、业务、数据等仍具价值,Cognition计划整合技术打造生态。