「GPT-5.1 Pro」共找到 3695 篇相关文章
估值1亿的"死了么"APP有多好抄?5分钟AI就能复刻,去年有人一下午做出原型
‘死了么’APP 爆火并更名 Demumu,虽开发成本低却估值达 1 亿。此前有数据分析师曾用 AI 5 分钟复刻其海外版。该 APP 由三名 95 后开发,现下载量猛增,还面临竞品挑战。
多模态模型具备“物理推理能力”了吗?新基准揭示:表现最好的GPT-o4 mini也远不及人类!
来自多机构研究人员构建PhyX基准测试,评估多模态模型物理推理能力。测试显示,即便表现最佳的GPT - o4 mini准确率仅45.8%,远不及人类的75.6%,且模型在多方面存在结构性缺陷。
雷军:小米一直有一颗芯片的梦想
9月25日晚雷军年度演讲深情坦言,小米一直有造芯梦想。其造芯始于2014年松果电子,澎湃S1虽量产但未成功,后停掉SoC研发。2024年小米成功流片3nm芯片,玄戒O1首发于小米15S Pro,表现出色,但雷军称其成功只是第一步。
社区供稿 | 全能高手&科学明星,上海AI实验室开源发布『书生』科学多模态大模型 Intern-S1 | WAIC 2025
7月26日,上海AI实验室在WAIC 2025上发布并开源科学多模态大模型Intern-S1。它融合书生家族优势,首创跨模态科学解析引擎,在多学科任务上超越顶尖闭源模型,技术创新显著,未来将持续开源。
DeepSeek出品,必是精品!DeepSeek-OCR 2发布:让LLM像人一样读懂复杂文档,效果超Gemini 3 Pro
DeepSeek推出DeepSeek-OCR 2,提出“视觉因果流”,以全新视觉编码器赋予模型因果推理能力。它在文档解析基准表现超Gemini 3 Pro,代码和模型权重已开源,为2D推理和原生多模态探索铺路。
卡帕西8000行代码手搓ChatGPT,成本仅100美元,训练12小时CORE表现超越GPT-2,手把手教程来了
AI大神Andrej Karpathy新作nanochat,用8000行代码、100美元成本纯手搓克隆ChatGPT。它是极简全栈训练/推理pipeline,训练12小时,CORE表现超GPT - 2,还给出快速上手详细指南。
24小时直播,只靠一张照片?虎牙实时多模态数字人VAM 1.0率先突围行业三堵墙
虎牙推出实时多模态数字人VAM 1.0,只需一张照片就能转化成能说会唱、可实时互动的数字人。它解决了AI数字人行业的时间、交互、部署三堵墙,稳定性、交互精度和响应速度表现出色,应用场景广泛。
解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换
视觉-语言-动作(VLA)模型是端到端自动驾驶主流技术,但自回归解码架构有瓶颈。复旦大学与引望智能联合提出WAM-Diff2,实现自回归VLA向离散扩散模型迁移,解码加速15.1倍,多任务性能不降。
谷歌年度大招:所有AI模型全升级一遍!Gemini2.5大杯中杯霸榜前二,新版视频/图像模型亮相
谷歌在I/O大会放大招,升级所有AI模型,重做原有产品,推出诸多实验性新产品。如Gemini 2.5系列升级,具备新功能;还有异步代码助手Jules、新搜索模式等,多模态模型也全线升级。
GitHub Trending 榜一的开源 Cowork 来了!4天4.5K星,首个多智能体工作流应用!
开源项目Eigent冲上GitHub Trending榜首,4天获4.5K+ Star。它是全球首个多智能体工作流桌面应用,完全开源、支持本地模型,有多种智能体工作流,具备本地优先、并行工作流等特性,提供三种使用模式。