性能对比」共找到 2306 篇相关文章

算法论文8

破解MoE模型“规模越大,效率越低”困境!中科院自动化所提出新框架

大模型参数量飙升却陷入‘规模越大,效率越低’困境,中科院自动化所研究团队提出统一框架,直击MoE底层运作模式,让专家‘组队学习’,实现参数量、负载方差降低,达成三重优化。

量子位
新闻资讯8

CUDA内核之神、全球最强GPU程序员?OpenAI的这位幕后大神是谁

AI圈聚光灯常聚焦明星人物,OpenAI一位工程师因编写关键CUDA Kernel引发关注,网友猜测是Scott Gray。他在Nervana开发maxas、maxDNN,加入OpenAI后开发块稀疏GPU内核并开源。

机器之心
开源动态8

谷歌开源新Deep Research范式,教Agent学会真正的思考。

周末谷歌发博客讲Deep Research,它重新定义一些Agent常见范式。现在多数Agent模式缺全局观,谷歌让AI先打草稿再迭代修正。新框架含技巧,在多任务上超OpenAI,已可试用。

探索AGI
算法论文8

GPT-5-Codex背后AI Agentic编程技术最新全面综述!

近期OpenAI发布GPT - 5 - Codex,其背后AI Agentic Programming重塑软件开发流水线。介绍了AI Agentic编程定义、典型工作流、技术底座、主流Agent对比分类,还展望未来5大机会。

PaperAgent
开源动态8

国产大模型持续开源的一周:DeepSeek、Qwen、字节、书生~

国产开源大模型持续发力,本周DeepSeek V3.1、字节Seed-OSS-36B等接连发布。此外,马斯克xAI正式开源Grok 2.5,英伟达也开源了Nemotron-Nano-9B-v2。PaperAgent专题进行了梳理盘点。

PaperAgent
产品应用8

刚刚,Claude Code推出自动安全审查功能,顺便干掉了10家安全创业

Claude Code推出自动化安全审查功能,有 `/security-review` 命令和GitHub Actions集成两大核心能力,能检测多种漏洞,与传统SAST工具比优势明显,还能解释问题并提供修复建议。

AGI Hunt
开源动态8

腾讯AI Lab开源可复现的深度研究智能体,最大限度降低外部依赖

腾讯AI Lab推出全开源智能体框架Cognitive Kernel - Pro,解决现有开源框架依赖付费工具问题。它有模块化架构等核心设计,创新训练方法,在多任务中表现出色,降低外部依赖,相关论文登HuggingFace热榜。

量子位
开源动态8

The Batch: 855 | 为智能体而生

总部位于北京的 Moonshot AI 发布 1 万亿参数的 Kimi K2 系列大语言模型,包括预训练和微调版本。它输入输出能力强,架构独特,在多基准测试领先,支持工具调用,多家服务商已集成。

DeeplearningAI
开源动态8

全能高手&科学明星,上海AI实验室开源发布『书生』科学多模态大模型Intern-S1 | WAIC 2025

7月26日,上海AI实验室在WAIC 2025上发布并开源科学多模态大模型Intern-S1。它融合多学科知识,首创跨模态科学解析引擎,在多学科任务上超越顶尖闭源模型,还支撑构建了多智能体系统。

机器之心
产品应用8

干翻全场!OpenAI深夜发布通用Agent。

OpenAI 发布 ChatGPT Agent,将 Operator 和 Deep Research 能力融合,能在虚拟电脑完成复杂任务。它功能强大亮点多,但也存在价格昂贵、安全隐患等问题,或压缩创业公司空间。

探索AGI