新推理模型」共找到 9747 篇相关文章

开源动态7

MotlBot作者被Claude刁难后:MiniMax M2.1是最优秀的开源模型

Moltbot热度不减,开发者挖掘其实用价值,阿里云、腾讯云上线相关云服务。Moltbot作者Peter接受采访,分享项目起源、开发思路等,认为MiniMax M2.1是优秀开源模型,还探讨了智能体发展及项目后续规划。

量子位
产品应用8

社区供稿 | GLM-4.5技术博客:原生融合推理、编码和智能体能力

文章介绍 GLM-4.5 和 GLM-4.5-Air,二者旨在统一推理、编码和智能体能力。在 12 个基准测试中表现良好,采用 MoE 架构等技术,还开源 slime 框架。文中展示其多方面应用,并说明使用方式。

Hugging Face
算法论文8

Vision-Zero:零数据VLM自我进化!陈怡然团队提出零监督训练范式

陈怡然团队提出零监督训练范式Vision-Zero,在多模态任务表现突出。它借鉴自博弈技术,设计自博弈框架,解决数据稀缺和知识天花板问题,还缓解跨能力负迁移,开源代码与模型可供研究。

机器之心
新闻资讯8

预测太阳磁暴全球最强!首个空间天气链式AI预报模型亮相WAIC

在WAIC上,我国发布全球首个全链式空间天气AI预报模型“风宇”。它首创链式训练结构,整合孤立环节;基于天地一体化观测数据,在多区域短临预测表现卓越,误差低,已申请多项专利,还可用于航天器设计管理。

量子位
开源动态8

对标GPT-4o和香蕉!浙大开源ContextGen:布局身份协同SOTA

浙江大学ReLER团队开源ContextGen框架,攻克多实例图像生成中布局与身份协同控制难题。基于Diffusion Transformer架构,用双重注意力机制实现布局精准锚定与身份高保真隔离,在基准测试中超越开源SOTA模型,对标GPT - 4o等闭源系统。

新智元
新闻资讯7

B站爆了!Hermes首度直播回应「抄袭」,MiniMax提前杀入Harness赛点

Hermes Agent业务负责人回应抄袭质疑,技术对谈探讨AI竞争维度。MiniMax动作密集,构建“Model + Harness”双向飞轮,其模型获海外开源圈认可,产品驱动模型优化,还与云厂商合作解决沙箱问题。

新智元
算法论文8

传统RAG只会翻书不会用?RAG+让Reasoning能力上一个高度!

现有检索增强生成(RAG)技术在需复杂推理领域表现不佳,像只给菜谱不给实操演示。RAG+开创性增“应用案例库”,与知识库构成双料库,在数学、法律、医疗场景测试中全面碾压传统方案,团队还透露了未来方向。

深度学习自然语言处理
算法论文8

OpenClaw代码越改越崩?研究EvoClaw揭示:Agents持续开发成功率仅13.37%

USC邓港大等联合发布评估基准EvoClaw,揭示AI在持续开发场景下表现不佳,成功率仅13.37%。研究还指出当前评测易高估AI能力,提出DeepCommit重构演进历史,分析各模型在持续演进中的局限与问题。

量子位
新闻资讯7

硅谷VC玩法"Kingmaking":还没写代码也能拿到上千万投资

过去半年,三家未成型AI公司各获超5000万美元投资。如今VC采用“造王术”,在代码未写时就砸钱。因大模型烧钱、头部效应强,投资人想用钱堆出“冠军”,这也给小团队带来机会。

AI工程化
新闻资讯7

独家|能量桥完成⼀轮融资,Monolith领投,中科创星跟投

近日,能量桥完成一轮融资,由 Monolith 砺思资本领投,中科创星跟投。该公司核心团队经验丰富,其预制化超导能源模块可实现数据中心配电零损耗。在 AI 算力建设背景下,超导技术或成输电破局点。

DeepTech深科技