T(R,O) Grasp」共找到 721 篇相关文章

开源动态8

毫无征兆!DeepSeek R1爆更86页论文,这才是真正的Open

两天前,DeepSeek悄无声息把R1论文从22页更新到86页,将其升级为开源社区可复现的技术报告。新论文干货多,如精确数据配方、基础设施说明等,且多项实力媲美甚至赶超OpenAI等闭源模型。

新智元
新闻资讯7

爆冷!字节Seed 在CCPC 决赛只做出一道签到题,而DeepSeek R1 直接挂零?

第十届 CCPC 举行,字节 Seed 携 Seed - Thinking 参赛,仅做出一题,DeepSeek R1 挂零。不同模型架构在比赛中差异不大,暴露出大模型做算法题短板,推理模式模型表现更好。

AI前线
新闻资讯7

「回答一切」吐槽潮中 Sam Altman 确认: 4o 回归,GPT-5 将进行六大改进

OpenAI在Reddit举行GPT - 5问答活动,网友吐槽多。Sam Altman确认GPT - 4o回归,还表示GPT - 5将进行加倍调用速率、保留旧模型选择权等六大改进,同时回应了用户对旧模型、调用限额等方面的质疑。

AI寒武纪
算法论文8

重磅!DeepSeek R1论文经过同行评议登上Nature封面,梁文锋作为通讯作者再次创造历史

DeepSeek R1论文《DeepSeek - R1 incentivizes reasoning in LLMs through reinforcement learning》登上Nature封面,梁文锋为通讯作者。它是首个经同行评议的有全球影响力的LLM,训练成本低,创新使用‘纯粹强化学习’方法,启发众多研究。

AI寒武纪
产品应用7

打破 AI 辅助开发碎片化困境,阿里巴巴 R2C Agent 的 AI 编程实践

文章围绕阿里巴巴 R2C Agent 的 AI 编程实践展开。指出当前 AI 辅助开发存在与生产链路结合难、协作碎片化等问题,介绍了 R2C Agent 如何驱动研发链路,阐述其框架、实施情况及未来提升 AI 渗透率的目标。

InfoQ
产品应用7

新DeepSeek R1代码能力直逼Claude 4!附生成任何优质网站的通用提示词

作者体验DeepSeek R1超8小时,发现其文本写作问题大幅修复,思维链推理改进,代码能力提升,前端审美直逼Claude 4。文章展示其前端能力,给出写前端网页提示词及设计逻辑,还探讨了其在复杂任务中的表现。

花叔
开源动态8

蚂蚁专用模型超越o3!仅用2K训练样本刷新医疗AI榜单纪录

蚂蚁集团联合团队发布《MedResearcher-R1: Expert-Level Medical Deep Researcher》报告,其医学AI智能体MedResearcher-R1用2100条训练样本在医疗基准测试反超通用大模型,靠数据、工具、训练方法三大创新实现突破。

量子位
新闻资讯7

“还我GPT-4o”!奥特曼强推GPT-5惹怒网友,紧急公关来了

GPT-5上线后遇冷,OpenAI直接关闭既往所有型号,让网友不满。原因是GPT-5人机感重,缺乏写作创意和情感共鸣。无奈之下,奥特曼宣布付费用户可切换回4o,同时会继续更新GPT-5。

量子位
新闻资讯7

OpenAI o3封王,4比0横扫马斯克Grok 4!全球大模型对抗赛完美收官

Kaggle AI国际象棋锦标赛中,OpenAI o3以4-0横扫Grok 4夺冠,这场比赛也被视为OpenAI与xAI的“代理人战争”。季军战里,Gemini 2.5 Pro击败o4 - mini获铜牌。大赛旨在检验大模型多方面能力。

新智元
新闻资讯7

o4-mini暴击六大数学天团,攻破陶哲轩难题!4.5h激战人类阵地失守

Epoch AI团队举办竞赛,约40位数学精英分成8组与o4 - mini - medium在FrontierMath基准上对决。o4 - mini击败6组团队,虽未完全超越人类,但Epoch AI预测到2025年底AI可能超30% - 50%人类基准。

新智元