指标证据链」共找到 668 篇相关文章

开源动态8

快慢思考不用二选一!华为开源7B模型实现自由切,精度不变思维减近50%

华为发布openPangu-Embedded-7B-v1.1,参数7B却有双重“思维引擎”。采用渐进式微调策略和快慢思考自适应模式,可自由切换快慢思考,在多评测中精度提升,思维减近50%。还推出openPangu-Embedded-1B小模型。

量子位
新闻资讯7

NeurIPS 2025:高分论文也可能被拒,只为保住那25%左右的接收率?

NeurIPS 2025将于2025年12月在美国圣地亚哥和墨西哥城举办。近期Meta Review完成,有领域主席称DB track高分论文也可能被拒,因要控制接收率。有学者呼吁提高接收率,也有人吐槽这种做法影响会议声誉。

机器之心
开源动态8

港大联手月之暗面等开源OpenCUA:人人可造专属电脑智能体

香港大学 XLANG Lab 和月之暗面等多家机构提出用于构建和扩展 CUA 的完全开源框架 OpenCUA,含注释工具、大规模数据集等,还构建旗舰模型 OpenCUA - 32B,公开代码、数据和模型。

机器之心
新闻资讯7

稚晖君和王兴兴,打起了人形机器人关键一仗

科技圈风口聚焦人形机器人,宇树科技和智元机器人争夺“人形机器人”第一股。两者虽产品线和应用场景有共性,但商业化进程、战略打法和组织结构差异大,代表不同具身智能发展路径。

芯师爷
算法论文8

一文读懂深度表格数据表示学习 | 南京大学

南京大学团队系统介绍表格表示学习领域,将现有方法按泛化能力分三类,比较DNN与树模型优劣,剖析核心挑战,探讨扩展方向及数据集评估策略,旨在建跨数据集稳健评估体系。

量子位
算法论文8

ICML 2025 Spotlight | 多模态大模型暴露短板?EMMA基准深度揭秘多模态推理能力

最新研究推出 EMMA 基准测试,揭示顶尖多模态大语言模型在深度视觉与文本融合的复杂多模态推理上显著不足。该研究已被 ICML 2025 接收,代码数据开源。实验表明,现有模型与人类专家差距大,视觉推理是核心瓶颈。

机器之心
开源动态7

功能全面的Agent!吸取了open-manus,langmanus众家之长

Cooragent是在langmanus基础上重大改进的Agent框架。文章介绍其本地部署、CLI工具使用、添加MCP服务等实战操作,还提及深度兼容Langchain工具、支持MCP等特点,有两种工作模式。

CourseAI
新闻资讯7

传言称:Llama 4 团队80%成员集体辞职!

有爆料称Meta的Llama 4团队约80%成员集体辞职,引发AI圈关注。但Meta员工澄清该消息不准确,且无权威媒体证实。不过Meta和Llama 4项目确实面临高层动荡、模型延期等问题,还分析了可能的深层原因。

AGI Hunt
推荐文章8

Anthropic 发布 AI Native 全流程实践指南

Anthropic应用AI团队发布实践指南,阐述如何将AI融入软件开发生命周期各环节。指出代码不再是瓶颈,构建快但周边流程慢。指南围绕六阶段展开,给出实施步骤、治理框架和度量指标

AGI Hunt
产品应用7

本地部署Qwen 3.8 27B,要用什么配置

Qwen 3.8 27B是性能好、体积小的开源模型,个人也能本地部署。本地跑开源大模型,重点看容量和带宽两个指标,还介绍了Mac、RTX 5090、RTX PRO 6000三种部署方案及优缺点。

newtype AI