「OpenAI o3」共找到 3773 篇相关文章
Fable5仅做对3.5%!大模型会看图,但还没有主动视觉
本文介绍了专门测量「主动观察」能力的视觉推理基准 ActiveVision,评测显示无外部工具时,大模型与人类准确率有近 9 倍差距,用工具后虽提升但仍远不如人类,还说明了其出题与避免取巧的方式。
7.3K Star!用 Orca 组建 AI 舰队:让 Claude Code 和 Codex 同时开工!
Claude Code 大火后,多家大厂推出自家 Code CLI,多终端操作上下文切换成本高。Orca 是开源 AI 编排器,可让多个 AI 编程助手并行工作,集中查看结果,有并行工作区、统一管理界面等亮点。
无需多视角,单图重建可交互3D模型!南洋理工开源结构推理框架
南洋理工大学团队提出MonoArt,将单目可动物体重建建模为渐进式结构推理过程,通过四个关键模块逐步推理,无需外部先验,在PartNet - Mobility基准测试中表现领先,兼顾推理效率,还可用于下游任务。
OnlyOffice 平替,用 Vue3 + Vite 做了个“本地 OnlyOffice”:接入成本低到离谱!!!
文章介绍 onlyoffice-web-local 项目,它是基于 OnlyOffice 的纯前端本地网页文档编辑器,无需服务器端处理,部署轻、接入快、更安全。阐述其功能、适用场景,给出开发部署及集成方案,可作 OnlyOffice 平替。
Anthropic 黑客松冠军开源神作!3 万人收藏的神级 Claude Code 升级包!
Claude Code在处理复杂项目时存‘记性不好’等问题,单打独斗难敌复杂工程需求。Anthropic黑客松冠军得主开源Everything Claude Code项目,涵盖多模块,是系统化AI协作体系,已获30K+ Star。
NTU S-Lab 团队探索可动 3D 新方向:结构、关节、纹理一次到位
南洋理工大学 S-Lab 团队发布研究,提出统一建模框架,能从单张图像生成可动三维对象,在几何精度、外观一致性与运动合理性上显著提升,解决了现有方法的难题,为相关领域发展奠定基础。
刚刚,千问App把谷歌和OpenAI的「付费绝活」塞进了手机,还免费?
千问App迎来史诗级更新,接入阿里两大视觉模型Qwen - Image和Wan 2.5。Qwen - Image在图像编辑上有强大视觉逻辑理解和一致性保持能力;Wan 2.5能实现原生音画同步。千问App还实现一站式工作流。
谷歌杀入诺奖神殿,两年三冠五得主!世界TOP3重现贝尔实验室神话
2025年谷歌关联科学家再获诺贝尔物理学奖,使其两年内收获三项诺奖、五位得主。此前2024年已有三位相关科学家获奖。谷歌成继贝尔实验室与IBM后,最具「诺奖基因」的科技企业。
开源AI教育视频生成神器,3Blue1Brown风教学动画一键搞定!
新加坡国立大学Show Lab团队开源Code2Video,能让代码变高质量教育视频,逻辑是用代码驱动视觉效果。它有智能解析等特性,可解决传统教学视频形式单一等问题,应用场景广泛。
陶哲轩联手GPT-5,1小时攻克数学难题!全程无需编码,OpenAI副总惊呼
陶哲轩联手ChatGPT攻克MathOverflow复杂数学题,节省数小时编码时间。他先让ChatGPT生成代码,后改用分步对话找参数,还验证结果。AI助其发现错误、优化流程,凸显在数学研究的潜力。