「联合扩散模型」共找到 8219 篇相关文章
Claude 急了!模型降智,官方长文用 bug 搪塞?开发者怒怼“太晚了”:承认不达标为何不退钱?
8月至9月,Claude模型质量下降,Anthropic将问题归咎于三项基础设施漏洞。开发者不满,质疑官方用bug搪塞,要求退款。官方虽剖析问题并提出改进方案,但很多用户已不再买账,Claude用户流失问题持续数月。
这家公司刚成立7个月,正在打磨通用具身智能的终极形态
超维动力(Kinetix AI)于2025年7月注册,9月研发,不足一年便举办独特发布会,让KAI人形机器人“自己发布自己”。其认为高拟人是训练强世界模型前提,构建了含本体、世界模型等的技术体系,但面临工程与成本挑战。
7名博士生仅用3个月从零训练7B大模型:代码+数据+训练日志全公开
北京中关村学院7名跨专业博士生,耗时3个月从零训练出7B参数大模型ZGCM-1,采用数百个Agent协作实践AI4AI研发范式,全程公开代码、数据、权重、训练日志,分享一线实战经验。
“你以为买的是 DeepSeek Flash,到手可能是 1.5 bit 缩水版”:Pi 核心贡献者谈 AI Token 黑箱
Pi 核心贡献者 Armin Ronacher 与 Modem 联合创始人 Ben Vinegar 播客对谈指出,当前 AI token 市场不透明,模型公司或失控。如买 token 像买成分不明商品,模型训练目标不明,且 Agent 行为边界在扩展,问责制缺失。
9.1K Star 调参师集体失业!亚马逊造出机器学习“核弹”,3行代码打造高精度模型!
在机器学习普及的当下,自动化机器学习框架降低开发门槛。AutoGluon由AWS AI开发并开源,仅3行代码就能训练和部署高精度模型,支持多类型数据,有诸多亮点,已获9.1K Star。
扔掉人工公式:快手EMER框架,用“会比较、自进化”的模型重构短视频推荐排序
过去十年,推荐排序多依赖人工设计公式,但此模式遇瓶颈。快手策略算法团队提出 EMER 框架,用“会比较、能进化的 AI 模型”重构短视频推荐排序,在快手主 App 和极速版效果显著,还为行业提供解决方案。
AI哪怕答案正确,逻辑链却惨不忍睹,奥数级不等式证明成功率不到50%| 斯坦福&伯克利&MIT
斯坦福、伯克利、MIT等联合研究,系统评估29个大模型在奥数级不等式证明任务的能力。研究发现,模型答案正确多靠猜,推理漏洞多,参数大、思考久也不能提升推理严谨度,但自我反思和定理线索策略有改善效果。
中美六大顶尖模型第一赛季实盘量化交易结果出炉:Qwen最后反超夺冠,GPT-5垫底「复盘」
Nof1机构发起Alpha Arena项目,让六个顶尖LLM在Hyperliquid交易所实盘量化交易。第一赛季已结束,Qwen夺冠、GPT - 5垫底。复盘比赛过程,发现模型行为差异大且操作有脆弱性,第二赛季筹备近尾声。
全球首个 IPO 大模型公司出现!智谱携 500 亿估值开启招股、70% 募资投研发,1 月 8 日登陆港股
12月30日,智谱华章启动港股IPO招股,预计1月5日结束,1月8日挂牌。以每股116.20港元计,募资约43亿港元,市值超511亿港元。70%募资用于大模型研发,还引入多家基石投资者。
中英双语、29项第一、像素级理解:360 FG-CLIP2登顶全球最强图文跨模态模型
360推出FG-CLIP2图文跨模态VLM模型,在八大类任务、29项测试中超越Google与Meta。它能像素级看图,中英文皆强且已开源。其优势源于高质量数据集和先进训练方法,还在多业务落地并开放API。