「GPT-Image 2.0」共找到 3296 篇相关文章
专为终端设计 ,轻量快速,GB 大文件都秒开!
开源君发现一款基于 Rust 的终端文本编辑器 `Fresh`,目标是轻量、快速、功能强大,支持多平台,有7.1k+ star。它上手0门槛、轻量快速,有代码友好功能和丰富生产力工具,还支持插件扩展,提供多渠道安装方式。
玩转智能体协议:谷歌开发指南教你拼出工业级AI应用
谷歌两篇开发指南拆解六大前沿开放协议核心代码,从开发者挑战赛提炼五条架构法则。介绍各协议用途,如MCP消除重复劳动,A2A规范智能体通信等,阐述协议协同运作及架构法则助力工业级智能体应用开发。
死敌爆料是狠!OpenAI内部信阴阳Claude营收注水80亿,然后泄露了…
OpenAI首席营收官Denise Dresser给员工的内部信被泄露,信中透露Q2企业业务方向,还贬低对手Anthropic,称其300亿年化营收虚高80亿。此外,还提及OpenAI未来计划,如推新模型Spud、与Amazon合作等。
智谱GLM-5.1深度评测:8小时连续工作,开源大模型进入"工程交付"新纪元
2026年4月8日智谱发布GLM-5.1,它是全球首个通过真实工程任务验证8小时持续工作能力的开源模型,在SWE-Bench Pro上超越GPT-5.4等登顶。该模型性价比高、技术创新多,还适配国产硬件,开源生态友好。
OCR 发生了一件反直觉的事
百度 PaddleOCR 团队的 500 万参数模型 PP - OCRv5,在文字识别准确率上可与 Qwen3 - VL、GPT - 4o 等巨无霸模型抗衡。团队挑战‘模型越大,效果越好’,认为 OCR 中数据质量比参数重要,通过实验证明并优化数据。
Claude Code 推出 /loop 无限循环,一台电脑即可化身无数小龙虾
Claude Code发布v2.1.71,推出`/loop`功能,可让Claude在后台循环执行任务。它能将Claude Code从问答工具变为自主运转的Agent,配合CLAUDE.md和Git hook可构建自主Agent系统,还能同时跑多个实例。
为什么BF16的FlashAttention会把训练「炸掉」?清华首次给出机制解释,用极简改动稳住训练
社区里长期存在的FlashAttention+BF16训练GPT - 2时loss突然爆炸的问题,清华团队论文给出机制解释。指出是特定条件下数值偏置被放大所致,还给出极小修改稳定训练,且在多模型和硬件上验证有效。
斯坦福英伟达推出测试时强化学习:微调开源模型胜过顶级闭源模型,仅需几百美元
斯坦福、英伟达等提出TTT - Discover方法,基于开源模型gpt - oss - 120b,在测试阶段引入强化学习更新模型权重。它采用熵目标函数和PUCT启发机制,解决分布外问题,成本低且表现优,但目前适用于连续奖励场景。
OpenAI:如何用 Codex 在 28 天内极速打造安卓版 Sora
OpenAI发布工程博客,揭秘用Codex不到一个月打造Sora安卓版应用的过程。这款应用上线首日冲至Google Play下载榜第一,24小时内用户生成超百万视频,开发过程耗约50亿tokens,崩溃率仅0.1%。
Meta「分割一切」进入3D时代!图像分割结果直出3D,有遮挡也能复原
Meta MSL实验室发布三维重建模型SAM 3D,其家族的两个新模型能将2D图像转为3D重建模型,性能优异。同时,此前投稿ICLR 2026的SAM 3也亮相,可克服传统模型局限,在多项任务中刷新SOTA。