Claude 4.1」共找到 3869 篇相关文章

新闻资讯8

OpenAI 3万亿美元测试,AI首战44个行业人类专家!

OpenAI推出GDPval评估体系,通过真实工作任务审视大模型潜力,揭示AI从实验室走向3万亿经济战场的可能。早期测试显示,Claude Opus 4.1表现最佳,GPT系列进步快,模型在部分任务逼近人类专家水平。

新智元
新闻资讯7

刚刚,Claude两个新模型曝光!

开发者在Anthropic的API中发现Claude的两个新模型代号claude - marshmallow - eap和claude - melon - eap,目前处于内部测试阶段。社区有多种推测,且Anthropic命名风格改变,新模型或下月发布。

机器之心
新闻资讯7

GPT-5编程成绩有猫腻!自删23道测试题,关键基准还是自己提的

有人发现OpenAI测试GPT-5编程能力时,用的SWE-bench Verified子集仅477题,自行省略23题。若这些题默认零分,其得分比Claude Opus 4.1低。且该基准还是OpenAI自己提出的。

量子位
产品应用7

Claude Code 推出学习模式,比ChatGPT更激进:甚至能给你部署作业……

Anthropic为Claude Code和Claude应用推出全新学习功能,Claude Code支持切换交流风格,Learning模式像结对编程,会留作业。Claude实现方式比ChatGPT激进,开发者反响热烈,标志其向更智能教育方向发展。

AGI Hunt
新闻资讯7

xAI 22岁天才华人研究员:我们正以一敌十,Grok 4将无与伦比!

马斯克宣布Grok 4将在7月4日后发布,xAI华人研究员李天乐放豪言,称Grok 4智能无与伦比,且他们一人顶其他实验室10人。网友对此反应不一,马斯克也肯定Grok 4运行结果。

AGI Hunt
新闻资讯8

Grok 4源代码刚刚泄露!上线倒计时,马斯克xAI估值破1130亿,大模型要变天

xAI再获百亿美元融资,估值飙至1130亿。xAI控制台已有Grok 4和Grok 4 Code源代码流出,计划7月4日后发布。Grok 4智能无与伦比,或打破o3在榜单的领先地位,xAI将成OpenAI等对手。

新智元
开源动态7

推理成本骤降75%!gpt-oss用新数据类型实现4倍推理速度,80GB显卡能跑1200亿参数大模型

OpenAI在gpt - oss开源模型采用MXFP4数据类型,使推理成本降75%,内存占用为BF16模型四分之一,生成token速度提4倍,还能降低硬件资源需求。不过MXFP4也有缺陷,英伟达推出NVFP4提升质量。

量子位
开源动态8

DeepSeek V4没做的,MiniCPM-o 4.5给做「全」了~

上周 DeepSeek V4 发布,遗憾不是多模态。今天 MiniCPM-o 4.5 补上短板,凭 9B 参数实现端到端全双工全模态大模型,自 2026 年 2 月发布后 Hugging Face 下载量超 25 万。还推出多项成果,性能表现出色。

PaperAgent
7

10 小时连崩 4 次、Claude 疯狂宕机!刚把 ChatGPT 干到 295% 卸载量,就没顶住二次“爆红”?

3月2日,Anthropic旗下ClaudeClaude Code服务中断,10小时连崩4次。此前特朗普下令停用,Claude却因禁令用户量激增。受OpenAI与国防部合作影响,ChatGPT卸载量涨295%,Claude推记忆搬家功能促用户迁移。

InfoQ
开源动态7

一年后,DeepSeek-R1的每token成本降到了原来的1/32

几天前,DeepSeek更新R1论文至86页,公开训练全路径等细节。英伟达发表博客展示在Blackwell GPU上对其降本增效,通过软硬协同提升每瓦特Token吞吐量,还介绍了TensorRT - LLM软件及相关技术提升性能的情况。

机器之心