百炼模型服务」共找到 8201 篇相关文章

新闻资讯7

您猜怎么着?Grok 4进决赛,大模型对抗赛Gemini全军覆没,马斯克「装」起来了

谷歌举办的 Kaggle AI Chess 比赛中,半决赛 Grok 4 击败 Gemini 2.5 Pro 进决赛,o3 也战胜 o4 - mini 晋级。Grok 4 与 Gemini 2.5 Pro 对决焦灼,最终 Grok 4 涉险晋级,明天将与 o3 争夺冠军。

机器之心
开源动态7

Agent与工具交互平台级探索,只用接入一个MCP服务就能调用6000+工具

模型性能趋同背景下,知识库、工具成AI应用差异壁垒。MCP规范Agent与工具交互,但在实际生产中有挑战。ACI.dev项目维护者Aipotheosis Labs探索简化Agent与外部工具集成等过程,对企业级应用有示范意义。

AI工程化
产品应用7

newtype OS操作手册

作者黄益贺介绍newtype OS安装、配置与使用方法。它是定制化工具,比Claude Code更适合知识消化与内容产出。安装简单,配置需连模型供应商、给Agent配模型,使用时与Chief对话即可。

newtype AI
新闻资讯7

「一只手有几根手指」,你的GPT-5答对了吗?

CMU博士生Tairan He测试发现GPT - 5答错‘一只手有几根手指’问题,指出语言难满足视觉与机器人领域需求,需VLM和VLA模型。编辑部测试发现顶尖大模型面对常识问题也会‘翻车’,还探讨了应对方法。

机器之心
新闻资讯8

波士顿动力 | 人形机器人Atlas ,最新研究进展!

世界人形机器人运动会引发对自主机器人的讨论。波士顿动力与丰田研究院合作为 Atlas 开发大型行为模型(LBM),使其能自主完成复杂任务,研究团队展示成果并介绍模型构建流程、实践成果及研发原则。

AINLPer
开源动态7

DeepSeek终于丢了开源第一王座,但继任者依然来自中国

几千人盲投中,Kimi K2超越DeepSeek成全球开源第一,总榜第五紧追顶尖闭源模型。虽有人质疑其采用DeepSeek V3架构,但团队称有参数调整。当下开源模型崛起,正打破性能弱的刻板印象。

量子位
算法论文8

全图与切片并非等价?LLaVA-UHD-v3揭示差异推出高效全图建模方案

随着多模态大模型发展,处理高分辨率图像成关键。主流视觉编码范式难兼顾性能与效率,清华和中科院团队发布 LLaVA-UHD v3,提出 PVC 框架,对比 SBE 和 GNE,验证其在提升效率同时保留模型能力。

机器之心
开源动态8

最大开源第一视角数据集 EgoLive 来了,名校站台、近家机构争相申请

今年4月京东开源业界最大人类第一视角数据集EgoLive,已获近家机构申请。它用自研设备采集,经多模态处理,覆盖多场景任务。其数据用于JoyAI - RA训练,在真实场景验证效果好,还推动具身智能数据标准化。

InfoQ
新闻资讯7

前Meta大神创业,用强化学习打造PokeeResearch-7B模型,刷新AI深度研究SOTA

Pokee AI发论文介绍70亿参数的PokeeResearch - 7B模型,用基于AI反馈的强化学习和推理框架,在深度研究基准测试中成绩领先。该公司由前Meta大神创立,产品可打通多应用,已获融资并公开测试。

AIGC开放社区
算法论文8

【梁文锋署名】DeepSeek再发新论文:75%思考+25%记忆,这是他们算出来的最优解

DeepSeek新论文《Conditional Memory via Scalable Lookup》提出Engram模块,指出大模型用计算模拟查字典是浪费算力,Engram能给模型装“记忆”,还发现参数分配呈U型缩放定律,推理和长上下文能力提升显著。

花叔