「扩散式模型」共找到 8233 篇相关文章
训练即服务!让模型训练回归算法语义,150行代码跑通RL
ModelScope团队开源Twinkle框架,采用Client - Server架构,支持20余种算法组件。开发者约150行代码就能编排复杂RL训练循环,底层调度等交给框架。它兼顾易用性与灵活性,有多种特点和优势,代码已开源。
MMLU已死?「人类最后考试」登Nature:全球AI模型集体不及格!
AI发展迅猛,现有基准测试难以跟上其步伐。近1000名研究人员组成的全球联盟创建「人类最后的考试」(HLE),涵盖多领域难题,目前最强AI准确率不足50%,凸显AI与人类专家的差距。
GPT-5.4意外泄露!OpenAI最新模型瞄准这2大能力突围
GPT - 5.4疑似泄露,此前在OpenAI编码助手、GitHub代码拉取请求等多处有踪迹。传闻其将搭载200万Tokens上下文窗口,具备像素级精准视觉分析能力,不过也可能是炒作,网友关注其准确率。
1100多个模型殊途同归,指向一个「通用子空间」,柏拉图又赢一回?
约翰斯・霍普金斯大学研究发现,1100多个不同神经网络,即便训练条件不同,最终权重会收敛到共享低维子空间,表明架构比数据影响大。此发现能解释诸多现象,还有多种应用可能,但也有局限性。
大模型上天、马斯克发射GPU?中国团队直接建「太空超算」
2025年11月,英伟达送H100入太空,谷歌计划2027年发射81颗搭载TPU的卫星。美国欲打造太空生态闭环,中国中科天算等团队也在行动,中科天算目标是在太空建超算中心。
从 IROS 2025谈起,智能机器人何时迎来「GPT式爆发」? | GAIR Live 019
雷峰网邀请三位嘉宾解码IROS 2025背后具身智能前沿趋势。探讨了IROS现场变化、具身智能认知升级、Sim2Real实用边界、商业落地路径等,还预测具身智能“GPT时刻”或由“World Model+VLA”组合推动。
强化学习之父:大语言模型走错了路,不符合「苦涩教训」精神
2024 年图灵奖得主、强化学习创始人之一 Richard Sutton 在播客中批评 LLM 发展方向,认为其无真正智能,违背「苦涩教训」原则,缺乏持续学习能力,仅模仿人类,未理解世界。此观点引发 AI 社区激烈讨论。
胖东来式“爆改”后,一位制造业老板选择上AI | 甲子光年
捷配CEO周邦兵参加胖东来总裁班后,用其理念“爆改”企业,同时推进AI转型。他决心招募AI人才,重构PCB生产链路。9月23日,捷配发布“JetPave AI”,可降低硬件创新门槛,让创意更快落地。
拜拜Claude!阿里最强万亿模型编程秒了Opus4,实测在此
阿里推出总参数达1万亿的Qwen3 - Max - Preview (Instruct),比前一代Qwen3(235B)强四倍,发布即上线。官方测评显示它打败Claude Opus 4等对手,实测其编程能力出色,后续正式版值得期待。
今天,AI内容新规正式实施,这次不注意是真的会违法。
9月1日,《人工智能生成合成内容标识办法》及配套国标正式执行。其旨在解决AI虚假内容充斥问题,规定AI内容需打显式和隐式标识,对专业环节友好、公开传播严厉,还对相关方提出不同要求。