GPT-5.4 Pro」共找到 3335 篇相关文章

新闻资讯7

OpenAI认怂了:ChatGPT推广告?我们真没这意思,纯属设计失误

12月1日,ChatGPT Pro付费用户界面弹出应用推荐卡片引不满。早有添加广告预兆,Sam Altman态度转变。OpenAI称是应用建议,用户不买账,功能已暂停,而同期ChatGPT商业化价值也在显现。

AI工程化
新闻资讯7

马斯克的最快AI模型来了

xAI发布Grok 4 Fast,生成速度每秒75个token,比标准版快10倍。网友实测其解题、问答速度惊人,但也有准确性问题。它为求速度做了妥协,适合追求即时结果的用户。

量子位
开源动态8

SGLang 2025-8月性能优化技巧记录

本笔记记录2025年8月SGLang框架性能优化实践,涉及GPT - OSS、DeepSeek - V3等模型,采用allreduce_add_rmsnorm、量化、通信、内核融合等优化技术,在性能提升、减少延迟等方面效果显著。

GiantPandaLLM
算法论文8

GAIR Paper 107|高校联合腾讯发布 GameCraft-Bench:AI已能端到端开发游戏,Claude Opus 四成达到可玩水平

香港中文大学(深圳)等高校联合腾讯发布 GameCraft-Bench,旨在构建基于真实游戏引擎、产物完整可运行且能验证的 AI 游戏生成评测基准,解决现有基准难衡量端到端可玩性的问题,测试显示前沿模型在游戏生成上仍薄弱。

AI科技评论
产品应用7

Gemini 3.1 Flash-Lite Preview发布:Google完成AI模型分层布局

Google发布Gemini 3.1 Flash-Lite Preview,针对企业和开发者场景优化,速度快,有‘思考级别’功能。基准测试表现不错,价格比Claude 4.5 Haiku便宜,但开发者社区反应复杂,面临市场定位问题。

AI工程化
开源动态7

新玩法!Karpathy周末手搓“大模型智囊团”应用:各大LLM同台互评,代码已开源

Andrej Karpathy周末手搓Web应用llm - council,让多个大模型像顾问般提供建议。查询通过OpenRouter分发给多个大模型,它们互评后由‘大模型主席’生成最终回复,代码已开源。

AI寒武纪
算法论文7

多模态大模型理解物理工具吗?PhysToolBench提出了衡量多模态大模型对物理工具理解的基准

香港科技大学等团队提出 PhysToolBench,用于衡量多模态大模型对物理工具的理解。它将理解分为三个等级,测试 32 个模型,揭示了大模型在工具理解上的不足,也为未来发展指明方向。

机器之心
开源动态8

71.2%的惊人解决率,伦敦大学开源顶级AI代码修复智能体系统

伦敦大学等发布Prometheus AI系统,它将代码库变成知识图谱,解决9种编程语言的GitHub问题。由五个智能体协作,解决率高、成本低且已开源,或为AI编程新方向。

AIGC开放社区
算法论文8

让VLM学会「心中有世界」:VAGEN用多轮RL把视觉智能变成「世界模型」推理机器

当前VLM智能体面对复杂视觉任务表现不佳,美国西北大学等机构联合研究成果VAGEN,提出创新强化学习框架,奖励正确思考过程,让VLM在行动前构建内部世界模型,效果超多款闭源大模型。

机器之心
新闻资讯7

OpenAI估值5000亿,打平马斯克身价!一夜登顶全球最贵独角兽

外媒称OpenAI以5000亿美元估值完成员工「二次售股」交易,超越SpaceX成全球最大初创公司。同时马斯克个人财富冲破5000亿美元。OpenAI虽未盈利,但受资本追捧,还面临人才竞争,将连发新成果。

新智元