「自奖励训练」共找到 3130 篇相关文章
斯坦福×英伟达发布AI推理新范式,刷新了多领域SOTA
斯坦福与英伟达联合发布论文 TTT - Discover,提出新范式,不追求通用,在推理阶段针对特定难题修改模型参数。它战绩辉煌,但成本高、是偏科生且需打分器,其出现是技术与哲学的突破。
看到苹果和谷歌重磅联合声明的时候,我正在用 Gemini 写代码
苹果与谷歌达成合作,下一代Apple Foundation Models将基于Google的Gemini模型和云技术构建,为Apple Intelligence功能提供底层支撑。此前Apple Intelligence节奏慢、能力跳票,苹果或借Gemini补短板。
流式数据集:效率提升 100 倍!
现在只需一行代码,就能通过 `load_dataset('dataset', streaming=True)` 以流式方式加载数据集,无需下载。Hugging Face 优化后端,提升流式数据集速度与效率,减少请求、提升解析速度,还优化启动和流式加载阶段。
JetBrains放弃Fleet:急刹变道打造全新Agentic IDE,与VS Code、Cursor争夺下一代AI编程王座
本周,JetBrains 宣布停止开发 IDE 产品 Fleet,将精力投入新开发环境 Air。Fleet 自 2021 年推出一直处预览阶段,难取代 IntelliJ IDEA。公司称维持两条产品线易致用户困惑、分散精力。
750篇论文,彻底把统一多模态模型摸清了
未来迈向AGI需多模态AI系统。南大等联合发表综述,涵盖754篇文献。分析传统路线痛点,介绍统一多模态模型定义、技术路线、训练方法等,还提及应用场景及未来方向。
谷歌TPU逆袭英伟达,创始人一夜之间跃升全球第二、第三富豪
近期谷歌股价飙升,市值逼近4万亿美元,创始人财富排名跃升。其股价上涨源于AI领域双重突破:Gemini 3获赞誉,AI芯片业务有进展。英伟达回应称技术领先,谷歌逆袭有五大原因,如Gemini 3受欢迎等。
“交互式Scaling”:增加Agent与环境交互的深度和频率来提升性能
在AI发展中,商业研究Agent是“黑箱”,开源研究Agent性能有差距。MiroMind团队推出MiroThinker v1.0,提出“交互扩展”提升性能,在多基准测试表现出色,也指出了当前版本的局限。
成本仅0.3美元,耗时26分钟!CudaForge:颠覆性低成本CUDA优化框架
CUDA代码性能对模型训练与推理重要,但手动优化门槛高。明尼苏达大学团队提出CudaForge,是低成本多智能体CUDA Kernel生成与优化工作流,实验效果好,成本低且具通用性。
WithAnyone重磅开源:这可能是你见过最自然的AI合照模型
复旦大学携手阶跃星辰推出全新AI合照生成模型WithAnyone,它能生成自然、真实、毫无违和感的AI合照。该模型打破以往方法局限,当前ComfyUI版本已上线,还全面开源代码、模型权重等。
万亿美金赛道,迎中国破局者!AI重构新材料,「智造」时代开启
国产自研RhinoWise智能平台可将材料研发周期从数年缩至数月。背后的鼎犀智创完成数千万级融资,其以‘设计–模拟–制备–表征’闭环提升效率,产品将与国内龙头企业合作落地。