OpenAI开源模型」共找到 9809 篇相关文章

算法论文8

“坏”数据让模型更“好”?重新审视数据过滤

传统观点认为大型语言模型预训练应过滤“坏数据”,但论文《When Bad Data Leads to Good Models》提出反直觉观点,适度加入有毒数据,通过后训练技术可降低模型毒性,保持一般能力,挑战常规做法。

深度学习自然语言处理
新闻资讯7

刚刚,OpenAI想收购的Windsurf,被谷歌DeepMind抢走了核心团队

谷歌DeepMind宣布截胡OpenAI原本打算收购的Windsurf,其CEO与CTO发文欢迎Windsurf团队。此前OpenAI与Windsurf 30亿美元收购协议排他期已到期。Windsurf部分员工加入DeepMind,剩余团队将继续运营。

机器之心
新闻资讯7

OpenAI盯上苹果开发者生态,吞了家AI编程公司

OpenAI收购AI编程初创公司Alex,其产品是苹果Xcode量身定制版Cursor,集成智能助手到Xcode。此前OpenAI宣布GPT - 5内置于Xcode 26,收购或为与Anthropic竞争。

量子位
算法论文8

Meta提出StepWiser,让模型学会“反思”自己的推理过程

Meta提出StepWiser解决大语言模型推理逻辑正确性问题。它训练生成式评判模型,通过强化学习在线训练,能解释推理步骤好坏。实验显示其远超传统方法,为构建可靠AI系统提供新思路。

深度学习自然语言处理
推荐文章8

YOLOv8 模型训练入门指南:手把手搞定目标检测AI

本文是从零训练 YOLOv8 模型的完整实录,介绍了 YOLOv8 特点,以“识别猫”为例,详述训练步骤,指出训练难点,还推荐学习资源与工具,鼓励前端程序员尝试做 AI 模型训练。

AI Reading Hub
新闻资讯7

OpenAI公开4+10条保命指南,专防AI自动化攻击

OpenAI联合创始人兼总裁Greg Brockman在Blog中警告,前沿AI Agent能自主找漏洞并发动网络攻击,AI降低攻击门槛,防御端却未跟上。他分享OpenAI四项安全措施及防御者十项举措,呼吁行业共建安全生态。

量子位
新闻资讯7

金融智能体真的是大模型落地“最后一公里”?

InfoQ《极客有约》X AICon 直播栏目邀请业内人士探讨金融 AI 大模型实践现状。指出大小模型融合是主要方案,智能体有应用但也有问题。还分享了评估 AI 项目的要点、智能体应用案例及未来布局方向。

InfoQ
开源动态7

DeepSeek 把 Harness 开源了:模型、工具、Agent Loop 全是插件

8月13日,DeepSeek面向全球开发者开放DeepSeek Harness开发者预览版v0.1并开源代码。其特色是一切皆插件,提供四种运行模式,内置多Agent系统,有创新但编排范式未突破,还采用仅追加的会话日志。

InfoQ
新闻资讯7

刚刚,OpenAI苏黎世办公室被Meta一锅端,三名ViT作者被挖走

华尔街日报报道,Meta CEO 马克・扎克伯格挖走 OpenAI 苏黎世办公室的三位研究者 Lucas Beyer、Alexander Kolesnikov 和 Xiaohua Zhai。扎克伯格为夺回 AI 优势大力招人,开价诱人,OpenAI 也在反制。

机器之心
新闻资讯7

DeepSeek、GPT、Qwen,所有大模型架构图都有,Karpathy:宝藏画廊!

模型赛道热闹,架构创新多,理解困难且缺清晰架构图。AI 研究者 Sebastian Raschka 绘制主流大模型结构,整理成在线图谱「LLM Architecture Gallery」,方便研究者查阅对比。

机器之心