「o4 - mini - medium」共找到 463 篇相关文章
GPT-5.1曝光挽差评?救场背后,OpenAI 员工痛批Meta系的人正在“搞垮”公司!
近日开发者发现OpenAI仓库提及GPT - 5.1 mini,不过GPT - 5系列差评多,用户诟病其速度慢、性能差等。同时,OpenAI因大量招聘前Meta员工,让内部员工担心公司文化会像Meta,且对广告态度软化。
她如何把“系统2”带给了大模型 |对话微软亚洲研究院张丽
本文是量子位对微软亚洲研究院首席研究员张丽的访谈。张丽团队在2023年开始探索大模型深度推理能力,2025年1月发布rStar - Math,用蒙特卡洛搜索算法让7B模型实现o1级数学推理能力,引发广泛讨论。
OpenAI曝出第一颗芯片叫「辣椒」!AI自己设计,9个月流片
OpenAI首颗自研芯片Jalapeño问世,9个月从白纸到流片,创行业最快纪录。该芯片专为大模型推理设计,由其AI参与设计优化,有望降低推理成本,提升用户体验。OpenAI欲做全栈AI公司。
基于 Gemini 模型做 SEO Agent 简单实战
作者参加 Google I/O 大会后,受 James 用 AI 做 SEO 启发,尝试基于 Google 的 Gemini 2.5 Pro 模型制作 SEO 智能体。介绍数据获取方法,构建 3 个 Agent 进行分析、提建议和输出报告,Gemini 负责理解决策,适合出海企业。
看遍奥斯卡后,VLM达到电影摄影理解新SOTA|上海AI Lab开源
上海人工智能实验室等推出ShotBench、ShotVL及ShotQA,ShotBench含超3.5k问答对,ShotQA约7万个问答对。ShotVL在ShotBench评测中表现出色,3B参数的ShotVL-3B增益达19.0%,超越GPT - 4o等。
小米造芯:一个失败者重整旗鼓
小米曾在2017年澎湃S1铩羽而归,2021年重启手机SoC设计研发。此次玄戒O1一次流片成功后回片,表现超预期。文章分析了小米此前失败教训,介绍其芯片战略,还谈及产业特点与小米面临的挑战。
必须得让AI明白,有些不该碰的东西别碰(doge)
近期类o3模型在视觉推理任务表现优异,但陷入‘盲目用工具’状态。港中文MMLab等团队提出AdaTooler-V模型,具备自适应工具使用能力,还引入指标、算法,构建数据集,在多基准测评中优势明显。
突发!OpenAI「掀桌」:自研推理芯片「墨西哥辣椒」跑赢英伟达
OpenAI公布自研推理芯片Jalapeño(墨西哥辣椒)测试结果,它专为大语言模型推理设计,能同时提升吞吐量和降低延迟,在多模型测试中超NVIDIA系统。该芯片与Cerebras合作,计划2026年底部署。
梁文锋署名新论文,DeepSeek V4架构首曝?直击Transformer致命缺陷
新智元报道,梁文锋署名的DeepSeek新论文提出全新Engram模块,解决Transformer记忆难题。论文联手北大提出与MoE互补的“条件记忆”稀疏轴,通过Engram模块实现近似O(1)的确定性知识查找,或成稀疏LLM主流路线,下一代V4可能集成该方法。
Mistral 为 Le Chat 新增远程智能体与 Work 模式
Mistral发布1280亿参数的Mistral Medium 3.5模型,在Vibe和Le Chat引入云端智能体能力,还在Le Chat新增Work模式。新模型可自托管,支持长上下文窗口。社区反馈积极,开发者认可,也有人嫌定价贵。