「GPT-5-mini」共找到 2357 篇相关文章
The Batch: 862 | OpenAI 的重新"开放"
OpenAI 发布自 2019 年 GPT - 2 以来首个开源权重模型 gpt - oss 系列,含 gpt - oss - 120b 和 gpt - oss - 20b,为智能体应用设计,免费使用修改。介绍其输入输出、架构等,还对比了性能表现。
斯坦福临床医疗AI横评,DeepSeek把谷歌OpenAI都秒了
斯坦福最新大模型医疗任务评测,构建含35个基准测试的MedHELM综合评估框架。结果显示,DeepSeek R1以66%胜率领先,o3 - mini等模型也各有表现,还分析了成本效益。
OpenAI解密大模型失控:它不是变坏,而是「太听话」
OpenAI公开IH - Challenge,解决大模型指令冲突难题。指出大模型问题多因听信错误指令,给出系统>开发者>用户>工具的指令层级结构,设计数据集训练模型遵循高信任等级指令,提升安全可控性与抵御提示词注入能力。
98%财务顾问依赖AI,揭秘7家先锋企业如何解锁商业新格局
OpenAI报告剖析7家前沿公司应用AI经验。如摩根士丹利评估后让98%财务顾问用OpenAI;Indeed用GPT - 4o mini优化职位匹配;Klarna用AI客服助手提升效益等,展示AI重塑企业运营的潜力。
阿里Qwen悄悄放出6个开源权重,国庆卷疯了~
国庆期间,阿里通义千问悄悄放出6个开源模型权重,Qwen3-VL是通义千问系列最强大的视觉 - 语言模型。其30B版本多模态表现媲美GPT - 5 - Mini等,功能与架构均有升级。
快手在 AI 上,渐入佳境
文章介绍快手多模态大模型 Keye-VL 1.5,参数 8B 适合中小企业。它侧重短视频场景,视频理解能力强,能与业务结合,提升推荐等场景效率。还详述其架构、预训练、后训练及训练架构优化等技术细节。
OCR 发生了一件反直觉的事
百度 PaddleOCR 团队的 500 万参数模型 PP - OCRv5,在文字识别准确率上可与 Qwen3 - VL、GPT - 4o 等巨无霸模型抗衡。团队挑战‘模型越大,效果越好’,认为 OCR 中数据质量比参数重要,通过实验证明并优化数据。
黑马图像模型被Nano Banana技术负责人点赞!15人华人小队,DDIM之父&CVPR最佳论文作者带队
Luma AI推出全新图像模型Uni - 1,对标谷歌Nano Banana Pro和GPT Image 1.5。它是统一图像理解与生成模型,多项评测表现出色。背后是不到15人的华人团队,由DDIM之父和CVPR最佳论文作者带队。
OpenAI o3封王,4比0横扫马斯克Grok 4!全球大模型对抗赛完美收官
Kaggle AI国际象棋锦标赛中,OpenAI o3以4-0横扫Grok 4夺冠,这场比赛也被视为OpenAI与xAI的“代理人战争”。季军战里,Gemini 2.5 Pro击败o4 - mini获铜牌。大赛旨在检验大模型多方面能力。
Claude 小升级就赢了OpenAI 9年“开源神作”?高强度推理直接歇菜、幻觉率高达50%,写作还被Kimi 2吊锤?
OpenAI发布首个开源语言模型系列gpt - oss,包括gpt - oss - 120b和gpt - oss - 20b,可在Hugging Face下载。同期谷歌、Anthropic也有新模型推出。gpt - oss有亮点,但也存在幻觉率高、实测效果差等问题。