编码性能」共找到 2241 篇相关文章

新闻资讯7

The Batch: 952 | GPT-5.5 性能领先,但幻觉问题突出

OpenAI 最新旗舰模型 GPT-5.5 是闭源视觉 - 语言模型,在重要基准测试中表现领先,但在区分已知未知内容上有困难,幻觉问题突出,在主观评估中落后于对手。

DeeplearningAI
开源动态8

刚刚,DeepSeek开源OCR 2,首创Qwen编码的「双流架构」

年底 DeepSeek 开源新模型 DeepSeek - OCR 2,首创双流注意力架构,model&paper 一同发布。它重构视觉编码器,采用三阶段训练流程,在 OmniDocBench v1.5 评测及生产环境验证中表现良好。

PaperAgent
算法论文8

复杂空间推理新SOTA,性能提升55%!中山大学新作SpatialDreamer

中山大学等机构推出SpatialDreamer,模拟人类空间认知过程,构建闭环推理流程,还提出GeoPO解决奖励稀疏问题,构建SpatialDreamer - SFT数据集。实验显示其在多基准达SOTA,为AI空间智能发展开辟新路径。

新智元
推荐文章8

Anthropic官方解密:3招上下文优化,破解Agent性能暴跌

本文是Anthropic官方文章翻译,从提示词工程拓展到上下文工程,阐述其构建方法。介绍上下文工程对构建智能体的重要性、上下文构成,还提及上下文检索、智能体搜索及长期任务的上下文工程解决方案。

AI产品自由
产品应用7

第九章 编码 Agent 实战——用 Deep Agents 构建代码审查助手

文章介绍用 `deepagents` 框架构建代码审查 Agent 的实战项目。此框架封装重复工作,让开发者专注业务逻辑。文中讲解其安装、最小运行示例,还介绍自定义工具及添加审查标准技能的方法。

CourseAI
产品应用8

第九章 编码 Agent 实战——用 Deep Agents 构建代码审查助手

文章围绕用 `deepagents` 框架构建代码审查 Agent 展开。介绍 `deepagents` 核心能力、安装配置,给出最小可运行示例。还阐述自定义工具及使用方法,添加审查 Skill 明确审查标准和流程。

CourseAI
开源动态8

性能飙升42%!人大&字节开源10万级 SWE数据集 Scale-SWE

近期,人大和字节开源10万级软件工程数据集Scale - SWE,用首创工作流从GitHub构建真实数据。基于此微调的Qwen3 - 30A3B - Instruct模型测试表现佳,其数据相比合成数据优势明显。

PaperAgent
新闻资讯7

The Batch: 920 | Nano Banana 2 在性能/价格比方面实现提升

Google发布Nano Banana 2(正式名称Gemini 3.1 Flash Image),是图像生成系统。它速度快约4倍、成本减半,支持多功能,在多个排行榜中位列前三,以低价接近文字 - 图片排行榜领先位置。

DeeplearningAI
开源动态7

「看」能否取代「读」,为何DeepSeek-OCR 爆火的重点不在性能

DeepSeek近期开源的DeepSeek - OCR在AI社区引发热议。它提出‘上下文光学压缩’理念,以视觉方式压缩文本。社区关注重点在其研究思路对NTP范式的影响,有望解决长上下文经济性难题等。

机器之心
产品应用8

又一款国产高性能GPU问世,实力对标海外巨头

2025年9月22日,芯动科技发布“风华3号”全功能GPU,它架构全面,功能覆盖广,在大模型等领域有多个突破,还适配多生态与系统。该产品能为多行业定制服务,标志国产GPU进入规模化应用阶段。

芯师爷