「模型训推」共找到 8160 篇相关文章

开源动态8

首个开源多模态Deep Research智能体,超越多个闭源方案

首个开源多模态Deep Research Agent登场,整合多种工具并优化决策。其WebWatcher技术方案覆盖全链路,实验中在四大核心领域领先主流模型,展现复杂推理和信息检索实力。

量子位
新闻资讯7

DeepMind率先拿下IMO金牌,却被OpenAI 抢先发布了……

2025年IMO成绩公布,中国队获团体第一,DeepMind和OpenAI模型都达金牌水平。但DeepMind因内部验证和规定未及时官宣,OpenAI抢先发布,引发科技巨头竞争、速度与流程等多方面讨论。

AGI Hunt
产品应用7

Cursor 0.50 版本升级后如何省钱又高效?一份给开发者的避坑指南

本文围绕Cursor编程助手日常应用展开,讲解计费机制、工具调用等核心要点,结合实践给出高效使用方法论与避坑指南,如合理选模型、巧用工具、设置规则等。

阿里云开发者
新闻资讯7

WWDC 2025 让大家“失望”了?no!苹果在下一盘AI大棋

苹果WWDC 2025未推出预期AI应用矩阵,股价下跌引失望。但实则是深思熟虑之举,它开放端侧模型及工具,让开发者创新,规避风险,待AI成熟凭借优势“后发先至”。

AI工程化
新闻资讯7

AI Infra 正在诞生自己的石油期货?GPU 不够买之后,华尔街开始交易算力

AI 行业焦点从 GPU 够不够用转向算力定价。2026 年 8 月 CFTC 就算力衍生品公开征求意见,CME 与 Silicon Data 计划推期货产品。但 GPU 算力金融化面临标准化、衡量方式等难题。

InfoQ
新闻资讯7

The Batch: 972|Grok 的 Cursor 联盟获得回报

SpaceXAI发布与Cursor联合开发的视觉 - 语言模型Grok 4.6,已向开发者开放。介绍其输入/输出、特性等信息,阐述工作原理、性能表现,还提及相关新闻背景、重要原因及期望。

DeeplearningAI
算法论文7

VQA高分是在看图,还是在记答案?ReKey只更新决定答案的那一小块

视觉问答模型准确率提升,但高分可能源于记忆。浙江大学等团队提出 ReKey,保留真实场景,只更新决定答案的视觉线索,使评测面向未见过内容,且多数环节可自动完成。

机器之心
新闻资讯7

紧跟诺奖得主,斯坦福经济学泰斗火速入职Anthropic!

IPO敲钟前夜,斯坦福经济学教授Charles I. Jones(Chad Jones)将加入Anthropic研究所。该公司正组建‘政经智囊团’,因民调显示64%美国人恐慌AI夺饭碗,需Chad Jones用经济学模型应对。

新智元
算法论文8

ACL 2026 | LCA:DeepSeek 长文本加速神器,90% KV 缓存缩减 + 2.5 倍推理提速

琶洲实验室等团队提出潜在空间压缩注意力(LCA),入选 ACL 2026。LCA 突破传统注意力机制瓶颈,适配不同大模型,降低硬件门槛与成本,提升推理效率。论文与代码已开源。

机器之心
新闻资讯8

吴恩达年度AI总结来了!附带一份软件开发学习小tips

AI大神吴恩达总结2025热门AI趋势,包括模型推理成标配、Meta引发人才争夺战、数据中心火热、智能体编程重塑软件开发。还给出软件开发学习建议,如参加课程、动手实践、读论文。

量子位