Grok 4.5」共找到 3025 篇相关文章

新闻资讯7

谷歌深夜放出 IMO 金牌模型,多项测试力压 Grok 4、OpenAI o3!网友评论两极分化

8月1日晚谷歌向Ultra订阅用户推Deep Think功能,Gemini 2.5 Deep Think模型在IMO夺冠。它是多智能体模型,能并行处理问题。多项测试中表现优于Grok 4、o3,不过网友评价不一。

AI前线
开源动态8

DeepSeek V4没做的,MiniCPM-o 4.5给做「全」了~

上周 DeepSeek V4 发布,遗憾不是多模态。今天 MiniCPM-o 4.5 补上短板,凭 9B 参数实现端到端全双工全模态大模型,自 2026 年 2 月发布后 Hugging Face 下载量超 25 万。还推出多项成果,性能表现出色。

PaperAgent
开源动态8

The Batch: 864 | GLM-4.5:一款开放的智能体竞争者

大型语言模型推动智能体能力交互竞赛正酣,中国 Z.ai 推出 GLM - 4.5 系列开源权重模型,在推理、编程等基准测试中表现出色,还介绍了其工作原理、研究和测试结果等。

DeeplearningAI
新闻资讯8

GPT-5.4暴击华尔街!白领工作灭绝时刻,美国5.7万科技岗位被血洗

OpenAI发布GPT - 5.4震惊AI圈。它能力超强,能颠覆白领工作,如让Excel变数据分析平台、超越咨询投行律所。美国科技行业岗位大减,但AI岗位需求飙升,诺奖得主警告AI会加剧不平等。

新智元
7

GPT-5.6现身后,下一个Claude Sonnet 4.8又曝光了!

GPT-5.5发布不久,开发者在Codex内部日志发现GPT-5.6,几乎同时,Anthropic的Claude Code源码泄露,炸出Sonnet 4.8、Jupiter等型号。两家公司下一代模型几乎同时曝光,模型迭代节奏在加速。

新智元
7

刚刚,DeepSeek V4 Pro正式版发布,多项对标Fable 5

刚刚,DeepSeek V4 Pro正式版发布,多项对标Fable 5,Agent能力几乎全方位碾压Opus 4.8,无限逼近Fable 5。API平台已更新,价格和之前Pro预览版基本一致,但网友实测发现CoT表现不佳。

量子位
算法论文8

全球排名前三,复旦自进化Harness Engineering让GPT‑5.4再涨7个点

2026 年以来,Harness Engineering 成业界热词。复旦大学等团队提出 Agentic Harness Engineering (AHE),可实现 Harness 自动优化。实验中,AHE 让 GPT - 5.4 分数提升,适配 GPT - 5.5 后排名全球第三,且有良好泛化能力。

机器之心
产品应用8

长文本推理 5 倍提速!面壁MiniCPM4 端侧模型发布,0.5B模型效果秒杀同级

近日,面壁发布 MiniCPM4.0 端侧模型,有 8B、0.5B 两种规模。其在基准测试表现出色,长文本推理提速,缓存锐减,还做了架构创新。此外,面壁有自研推理框架,科学化建模产线,6 月 27 - 28 日 AICon 北京站将探讨 AI 趋势。

AI前线
产品应用8

编程新王Composer 2.5来了,逼近Opus 4.7!成本仅为1/10

Cursor推出全新AI编程模型Composer 2.5,在部分编程基准测试上接近Claude 4.7 Opus和GPT - 5.5,运行效率最高提升10倍,成本仅为竞品一小部分。其采用定向文本反馈RL等机制,还与SpaceXAI合作冲击百万H100集群算力。

新智元
新闻资讯7

马斯克Grok 4逆天跑分泄露,「人类最后考试」豪取45%全场第一!

Grok 4跑分提前泄露,在「人类最后考试」中得分高达45%,远超Gemini与Claude,成为当前测试中最强模型之一。马斯克表示Grok 4以「第一性原理」构建推理机制,有望改写LLM格局。

新智元