GPT - 4o Mini」共找到 1082 篇相关文章

开源动态7

OpenAI解密大模型失控:它不是变坏,而是「太听话」

OpenAI公开IH - Challenge,解决大模型指令冲突难题。指出大模型问题多因听信错误指令,给出系统>开发者>用户>工具的指令层级结构,设计数据集训练模型遵循高信任等级指令,提升安全可控性与抵御提示词注入能力。

新智元
新闻资讯3

烧掉数万亿 Token、数百 Agent 连跑一周:Cursor“从零写浏览器”,结果是拼装人类代码?

Cursor CEO分享用GPT - 5.2让系统运行一周从零构建浏览器的实验,产出大量代码。但实验引发质疑,项目编译难通过,代码还依赖成熟库,像是拼装人类代码,且实验成本高。

InfoQ
产品应用7

别卷Agent了!这两款“AI算姻缘”App,靠收割美国人的孤独,狂赚200万美金!

当大厂为AGI、Agent烧钱时,“AI算姻缘”App Starla和Astra 20天狂赚超200万美金。它们以“GPT对话+AI生图+星盘概念”抓住人们对“灵魂伴侣”的渴望,靠低技术策略获高收益。

探索AGI
开源动态8

GLM-5深夜登场,这是国产开源模型首次逼平Claude Opus 4.5。

GLM - 5深夜发布且开源,参数量从355B扩展到744B,跑分仅次于顶级模型,开源排第1。能力逼近Claude Opus 4.5,BrowseComp基准得分超普通GPT - 5.2。价格便宜,是国内可用且性价比高的大模型。

数字生命卡兹克
7

谷歌Gemini最强性价比模型发布,1块8读完3本三体

谷歌推出Gemini 3.1 Flash-Lite,号称性价比最高的Gemini 3系列模型,每百万输入token仅0.25美元,读完3本《三体》只需1.8元。性能表现佳,还支持可调思考层级。两小时后ChatGPT推出GPT - 5.3 Instant回应。

量子位
新闻资讯8

陶哲轩惊叹!数学奇点初现,AI首次给出人类无法企及的原创证明

谷歌DeepMind团队用Gemini证明代数几何新定理,获斯坦福教授认可;Grok 4.20解决Bellman函数难题;GPT 5.2处理高阶数学问题能力惊人。陶哲轩预言AI或独自攻克部分埃尔德什问题,2026年或成「ASI元年」。

新智元
新闻资讯7

内部爆料,OpenAI 将发布神秘「OS模型」,员工惊掉下巴

OpenAI研究员Aidan McLaughlin推文称试用新os模型后很震惊,引发猜测。有推测是GPT - 5,也有认为OS可能指开源模型、新的o4模型或操作系统。从代码看,OpenAI或把ChatGPT升级为AI操作系统。

AGI Hunt
新闻资讯7

Default Alive:警惕 AI 公司“亏损死亡螺旋”| AGIX PM Notes

文章围绕AI公司发展展开,指出要警惕“亏损死亡螺旋”,真正存活的公司需平衡创新与盈利。还总结本周市场,如对冲基金加仓全球股票,同时介绍多起AI动态,像OpenAI发布GPT - 5等。

海外独角兽
新闻资讯7

Altman亲自发博客点赞,这两大杰出人才是谁?

Altman发博文介绍OpenAI两位核心研究员Jakub Pachocki和Szymon Sidor,称他们结合前沿研究与工程实践,对公司发展至关重要。文中还介绍两人履历贡献,提及OpenAI“宫斗”及用户对ChatGPT语音和GPT - 4o的不满。

机器之心
新闻资讯8

OpenAI 3万亿美元测试,AI首战44个行业人类专家!

OpenAI推出GDPval评估体系,通过真实工作任务审视大模型潜力,揭示AI从实验室走向3万亿经济战场的可能。早期测试显示,Claude Opus 4.1表现最佳,GPT系列进步快,模型在部分任务逼近人类专家水平。

新智元