在离线混部」共找到 8244 篇相关文章

产品应用7

DeepSeek识图模式全量上线,却认不出自家老板梁文锋

端午节前,DeepSeek全量推送识图模式。测试发现,它能认出黄仁勋,但忽略‘豆汁’字样,识别人物和潦草汉字准确率低,不过识别文物能力不错。还比较了与其他模型乐理推理测试中的表现,开发者有新疑问待解答。

机器之心
算法论文8

Monet:赋予多模态大模型如人类一般的抽象视觉思考能力

文章介绍了Monet模型,它实现了训练MLLM直接连续隐空间思考的方法,内化视觉思考能力。还阐述了多模态模型隐式推理训练的难点,提出SFT+RL训练框架,构建数据集,经测试,Monet提升了视觉推理能力。

机器之心
开源动态8

英伟达龙虾模型开源,12B激活登上成功率全球第四

英伟达发布专为龙虾打造的开源模型Nemotron 3 Super,总参数120B,激活参数12B,龙虾模型基准PinchBench上成功率全球第四。该模型结合Mamba与Transformer架构,引入多项创新技术,还开源了模型权重、数据集等。

AIGC开放社区
新闻资讯7

Anthropic:警惕评测排行榜!差别可能只是机器的内存更大,而已

Anthropic发工程博客指出,AI编程评测排行榜上排名前列的模型分差小,而运行环境硬件配置能让分数波动6个百分点。同一模型不同沙箱策略下分数不同,资源配置影响评测结果,排行榜分数差距或因硬件。

AGI Hunt
开源动态8

2.2K 标星的龙虾办公可视化项目!OpenClaw 专属的像素风「赛博办公室」!

由`海幸Hyacinth`和`Simon_阿文`联手打造的Star-Office-UI(龙虾办公室)GitHub开源,获2.2K标星。它把AI助手工作状态变成像素风看板,打破人机交互冰冷感,还具多亮点及API,上手简单。

开源星探
算法论文8

斯坦福英伟达推出测试时强化学习:微调开源模型胜过顶级闭源模型,仅需几百美元

斯坦福、英伟达等提出TTT - Discover方法,基于开源模型gpt - oss - 120b,测试阶段引入强化学习更新模型权重。它采用熵目标函数和PUCT启发机制,解决分布外问题,成本低且表现优,但目前适用于连续奖励场景。

量子位
产品应用8

别让米其林主厨削土豆!英伟达用「小脑指挥大脑」,重构AGI生产力

英伟达推出8B模型Orchestrator,通过组合工具降本增效。HLE等测试中超越GPT - 5,成本仅为其30%左右。它还能泛化到未见工具,具有可定制调度能力,标志着复合AI新范式的兴起。

新智元
算法论文8

用155万模拟视频给模型上课!GVE模型一次学会9种视频检索技能

当前视频检索研究陷入困境,现有模型难以应对复杂检索需求。香港科技大学(广州)联合阿里巴巴通义实验室推出通用视频嵌入模型GVE,其零样本设置下超越14个主流模型,全链条创新为视频检索通用化奠定基础。

量子位
算法论文8

AlphaGo之父找到创造强化学习算法新方法:让AI自己设计

谷歌DeepMind团队Nature发表论文,探索AI自主发现强化学习算法的可能。团队负责人是“AlphaGo之父”David Silver 。方法是基于智能体经验元学习,实验显示自动发现的规则表现优异,未来强化学习算法或无需人工设计。

机器之心
新闻资讯7

一封来自Transformer之父的分手信:8年了!世界需要新的AI架构

Transformer之父Llion JonesTED AI大会上称要把对Transformer的爱好调成「低电量模式」。他认为大量资金与人才涌入使研究被「收窄」,大家只顾卷参数、抢发论文,没人探索新架构,他呼吁找回好奇心。

新智元