混元世界模型1.5」共找到 9199 篇相关文章

新闻资讯8

陈大年复出,入局大模型

国产大模型领域黑马StartLux-V1.0-27B-Preview,参数量仅27B,在信通院MCP测试中排综合第二,仅次于1.6万亿参数量的DeepSeek-V4-Pro。其创始人陈大年押注本地模型,公司专注该领域商业化。

量子位
推荐文章7

DeepSeek-R1发布100天后:全面复盘推理大模型复现研究及未来!

推理语言模型(RLMs)发展显著,DeepSeek - R1发布引发广泛影响且未完全开源。MiroMind等总结其复现研究,关注SFT和RLVR方向,介绍数据构建、方法设计、训练过程细节及实验关键发现。

PaperAgent
产品应用7

Fable 5.1变身Token刺客,几分钟烧光额度!AI圈掀起「榨汁革命」

Anthropic发布的Fable 5.1虽性能强但极耗Token,引发开发者不满。当前AI产业面临算力饥渴与Token通胀问题,企业落地AI痛点多。迅策科技的TokenCloud平台能助力企业高效转化Token,还介绍了其配套产品TokenOS。

新智元
产品应用8

AI Coding新王登场!MiniMax M2.1拿下多语言编程SOTA

MiniMax发布旗舰级Coding & Agent模型M2.1,在Multi - SWE - bench榜单中以10B激活参数拿下49.4%成绩,超越竞品成SOTA。它解决模型‘偏科’问题,适配开发工具链,实测在多语言编程任务中表现出色。

量子位
开源动态7

MotlBot作者被Claude刁难后:MiniMax M2.1是最优秀的开源模型

Moltbot热度不减,开发者挖掘其实用价值,阿里云、腾讯云上线相关云服务。Moltbot作者Peter接受采访,分享项目起源、开发思路等,认为MiniMax M2.1是优秀开源模型,还探讨了智能体发展及项目后续规划。

量子位
开源动态8

腾讯混元开源 4 个小尺寸模型,主打 Agent 和长文

8月4日,腾讯混元开源四款小尺寸模型,参数为0.5B、1.8B、4B、7B,消费级显卡可运行,适用于低功耗场景。模型具备推理快、性价比高特点,亮点是Agent和长文能力,已在腾讯多业务应用。

InfoQ
开源动态8

刚刚,全球首个超高帧世界模型诞生!英伟达含量0,狂飙50帧

魔芯科技联合浙大潘云鹤院士团队发布全球首个Flash World Model——MoWorld,全栈基于国产NPU,实现50FPS实时推理,推理成本降70%,为世界模型产业化带来新思路。

新智元
开源动态8

四大顶尖模型对决!6000 字测评带你看Deepseek R1有多强

昨天 Deepseek-R1 0528 正式开源,作者让它与 Claude Opus 4、Sonnet 4、Gemini 2.5 Pro 在六个前端开发任务中对决。结果显示,Deepseek-R1 在多数测试表现出色,且价格优势明显。

歸藏的AI工具箱
新闻资讯7

o系列模型开创者,OpenAI研究副总裁官宣离职,还是codex,GPT-5,GPT-4核心

OpenAI研究负责人Jerry Tworek工作近七年后宣布离职,他是“波兰帮”成员、研究副总,贡献包括o1和o3模型、Codex等,离开是为探索在OpenAI难进行的研究。

AI寒武纪
算法论文8

网页智能体新突破!引入协同进化世界模型,腾讯AI Lab提出新框架

腾讯AI Lab提出WebEvolver框架,引入协同进化的世界模型,让智能体在真实网页环境中性能提升10%,突破现有基于LLM的网页智能体瓶颈,还通过实验验证了其有效性和对网页状态变化的预测能力。

量子位