性能评估」共找到 2549 篇相关文章

新闻资讯7

GPT-5.2刚发布就要被网友玩坏了~

11月19日Gemini-3-pro发布,一周抢1200万用户,OpenAI市值受威胁,GPT-5.2提前上线,专注推理、速度和削减幻觉。文中介绍其技术要点,也展示网友实测情况,如被Gemini-3.0碾压等。

PaperAgent
新闻资讯7

Claude Code 豪气收购一家0收入前端公司:押注一位高中辍学创始人

当地时间12月2日,Anthropic宣布收购热门开发者工具初创公司Bun。此次收购标志其向开发者工具领域迈进,因Bun能解决智能体分发和运行效率问题,且被众多AI编程工具使用。

AI前线
开源动态7

Karpathy组建大模型「议会」,GPT-5.1、Gemini 3 Pro等化身最强智囊团

前OpenAI联合创始人Andrej Karpathy发推称养成用LLM阅读习惯,还做了个新项目,让四个最新大模型组成LLM议会当智囊团。项目是Web应用,提问后多模型处理,有互评和投票机制,已开源。

机器之心
算法论文8

GraphRAG,这次被G-Reasoner统一了

大语言模型在知识密集型任务中存在局限,GraphRAG 也有迁移难题。G - Reasoner 提出统一框架,含 QuadGraph、GFM、LLM 增强推理模块,在性能、泛化、效率上全面领先现有方法。

PaperAgent
新闻资讯8

马斯克「世界模拟器」首曝,1天蒸馏人类500年驾驶经验!擎天柱同脑进化

特斯拉官宣「世界模拟器」,可模拟、合成自动驾驶的「孪生世界」,生成不同视角和长尾场景。它基于端到端神经网络,有学习人类价值观等优势。还能用海量数据解决难题,输出可解释中间结果,为自动驾驶和擎天柱训练服务。

新智元
推荐文章7

一文读懂:GPU之间是如何进行互联的?

文章介绍GPU互联技术发展,从早期SLI、CrossFire到双GPU卡,再到英伟达NVLink协议。详述NVLink 1.0 - 5.0各代升级,还提及DGX、HGX平台差异,以及NVIDIA GB300 NVL72超节点特点等。

芯师爷
开源动态7

最强DeepResearch!通义DeepResearch-30B开源实战:模型部署+LangGraph+A2A全攻略

阿里发布全开源项目通义DeepResearch,在研究任务评测中表现出色,底层是30B的MoE专用推理模型,资源需求低。文章演示了基于该项目构建本地化端到端DeepResearch助理的方法,包括模型部署、Agent实现等。

AI大模型应用实践
开源动态8

教多模态大模型学会“反思”和“复盘”,上交&上海AI Lab重磅发布MM-HELIX&AHPO,破解多模态复杂推理难题

上海交通大学和上海人工智能实验室研究团队带来MM - HELIX,这是完整生态体系,赋予AI长链反思性推理能力。其含基准测试、数据集、优化算法,搭载相关技术的模型表现优异,部分成果已开源。

量子位
算法论文8

破解MoE模型“规模越大,效率越低”困境!中科院自动化所提出新框架

大模型参数量飙升却陷入‘规模越大,效率越低’困境,中科院自动化所研究团队提出统一框架,直击MoE底层运作模式,让专家‘组队学习’,实现参数量、负载方差降低,达成三重优化。

量子位
新闻资讯8

CUDA内核之神、全球最强GPU程序员?OpenAI的这位幕后大神是谁

AI圈聚光灯常聚焦明星人物,OpenAI一位工程师因编写关键CUDA Kernel引发关注,网友猜测是Scott Gray。他在Nervana开发maxas、maxDNN,加入OpenAI后开发块稀疏GPU内核并开源。

机器之心