「训练可用度」共找到 5748 篇相关文章

推荐文章8

DeepSeek V3到V3.2的进化之路,一文看全

知名AI研究者Sebastian Raschka发布深度博客,详细梳理DeepSeek V3到V3.2进化历程。DeepSeek V3.2性能对标GPT - 5和Gemini 3.0 Pro,且为开放权重模型,报告涵盖众多有趣领域和知识。

机器之心
推荐文章8

大模型开发实战从入门到入坑:动手写一个MCP Server去理解MCP背后的技术原理

文章聚焦MCP协议,介绍其是规范应用向大模型提供上下文的开放协议,能让模型调用接口更简单、实现开发解耦。还深度解析技术原理,手把手教从0到1实现MCP Server,助读者理解背后技术。

阿里云开发者
产品应用8

X爆火Overleaf科研辅助神奇PaperDebugger

当下学术写作借助大语言模型辅助时,流程繁琐且上下文易丢失。新加坡国立大学团队推出的 PaperDebugger 是基于插件的多智能体系统,寄生在 Overleaf 编辑器内,可完成多任务,解决现有工具不足。

深度学习自然语言处理
开源动态8

英伟达巧用8B模型秒掉GPT-5,开源了

英伟达携手港大开源Orchestrator-8B小模型,在HLE测试中分数超GPT - 5,成本低且速度快。它靠ToolOrchestra训练法,协调工具解题。此赛道已有多项研究,小模型实用优势明显。

量子位
算法论文8

四足机器人首次同时「思考+走路」,北大提出链式推理MobileVLA-R1

在「大模型+机器人」浪潮中,让机器人既听懂话又走得对、稳很难。北大MobileVLA - R1将链式思考引入四足机器人,在仿真和真实实验中对标强基线实现提升,构建了更具工程可用性的范式。

新智元
新闻资讯8

从 LLM 到 World Model:为什么我们需要能理解并操作世界的空间智能?

文章指出 LLM 仅靠语言不足以支撑真正智能,构建空间智能与世界模型成关键方向。2024 年李飞飞等创立 World Labs,11 月推出 3D 世界生成模型 Marble,本文探讨空间智能重要性及世界模型如何成转变基础设施。

海外独角兽
新闻资讯8

当Gemini 3刷屏时,这款AI已开始救命了:原子级攻克「不可成药」靶点

全网关注Gemini 3时,Chai-2已开启生物学界「AlphaFold时刻」。它能原子级精准设计出可进临床的抗体药,攻克「不可成药」靶点,让很多难治疾病看到新药希望,AI造药开始起飞。

新智元
推荐文章8

99个最佳免费AI编程智能体与平台,2025年11月最新版

文章介绍了 99 个免费 AI 编程智能体与平台,含神级工具、国内科技巨头产品等类别。这些工具永久免费、开源或有云积分,适合学生、开发者等,能以 0 成本获得生产级 AI 编程技术栈。

AIGC开放社区
新闻资讯7

奥特曼想要一个「AI接班人」!劈柴:这一天会来的

近日,奥特曼自曝「AI接班人」计划,认为AI近年能胜任OpenAI部门管理,最终覆盖企业流程。OpenAI企业客户破百万,其构想或为盈利拼图。但目前AI难取代CEO,奥特曼若被取代就去当农民。

新智元
开源动态8

一个模型读懂所有医学数据,Hulu-Med探索医学大模型开源新范式 | 浙大x上交xUIUC

Hulu - Med是浙大、上交、UIUC等联合提出的通用医学视觉语言大模型,首次在单一模型统一理解医学多类数据。它开源透明,训练成本低,性能媲美GPT - 4.1,为医学AI带来新范式。

量子位