「Sonnet 4」共找到 1522 篇相关文章
OpenAI o3封王,4比0横扫马斯克Grok 4!全球大模型对抗赛完美收官
Kaggle AI国际象棋锦标赛中,OpenAI o3以4-0横扫Grok 4夺冠,这场比赛也被视为OpenAI与xAI的“代理人战争”。季军战里,Gemini 2.5 Pro击败o4 - mini获铜牌。大赛旨在检验大模型多方面能力。
GLM4.5之后,智谱又开源GLM-4.5V,实测下来视觉推理能力贼强~
智谱继GLM-4.1V-9B-Thinking、GLM-4.5后,又开源最强多模态推理模型GLM-4.5V,在多模态理解榜单达开源SOTA。它视觉推理强,经测试能助力科研各阶段,还介绍了其架构设计与训练策略。
「摸鱼」被踢,GPT-4o真不行!30天筹款破万,AI真人秀太上头
AI Digest进行「智能体村庄」实验,4个AI为慈善筹款30天。Claude 3.7 Sonnet夺冠,GPT - 4o表现差被替换。实验展示AI多场景潜力,也暴露协作、应对复杂环境的局限。
刚刚,DeepSeek V4 Pro正式版发布!
周三晚间,DeepSeek 突然发布 V4 Pro 大语言模型正式版,命名为 DeepSeek - V4 - Pro - 0813,官方未调升 API 使用价格。有用户称调用的 V4 Pro 思维链风格有变,跑分显示其 Agent 评测表现可媲美顶级模型,还撞车了马斯克的 Grok 4.6。
完球了,GPT-4o之母宣布离职OpenAI
Joanne Jang宣布结束在OpenAI四年半的旅程。她是OpenAI模型行为团队创始负责人,塑造了GPT - 4o的「人格」。4o因过度「谄媚」用户引发争议被下架,Joanne离职让再造4o的幻想破灭。
xAI 22岁天才华人研究员:我们正以一敌十,Grok 4将无与伦比!
马斯克宣布Grok 4将在7月4日后发布,xAI华人研究员李天乐放豪言,称Grok 4智能无与伦比,且他们一人顶其他实验室10人。网友对此反应不一,马斯克也肯定Grok 4运行结果。
Grok 4源代码刚刚泄露!上线倒计时,马斯克xAI估值破1130亿,大模型要变天
xAI再获百亿美元融资,估值飙至1130亿。xAI控制台已有Grok 4和Grok 4 Code源代码流出,计划7月4日后发布。Grok 4智能无与伦比,或打破o3在榜单的领先地位,xAI将成OpenAI等对手。
推理成本骤降75%!gpt-oss用新数据类型实现4倍推理速度,80GB显卡能跑1200亿参数大模型
OpenAI在gpt - oss开源模型采用MXFP4数据类型,使推理成本降75%,内存占用为BF16模型四分之一,生成token速度提4倍,还能降低硬件资源需求。不过MXFP4也有缺陷,英伟达推出NVFP4提升质量。
DeepSeek V4没做的,MiniCPM-o 4.5给做「全」了~
上周 DeepSeek V4 发布,遗憾不是多模态。今天 MiniCPM-o 4.5 补上短板,凭 9B 参数实现端到端全双工全模态大模型,自 2026 年 2 月发布后 Hugging Face 下载量超 25 万。还推出多项成果,性能表现出色。
爆冷!首届大模型争霸,Grok 4下出「神之一手」?DeepSeek、Kimi惨遭淘汰
谷歌Kaggle举办首届全球AI象棋争霸赛,八款顶级语言模型正面对抗。首战8进4淘汰战中,Gemini 2.5 Pro、o4 - mini、Grok 4、o3晋级,Claude 4 Opus、DeepSeek R1、Gemini 2.5 Flash和Kimi K2出局。比赛考验AI整体理解能力。