GPT - 5.3 - Codex」共找到 3929 篇相关文章

产品应用7

谷歌IMO金牌模型可以用了!推理性能秒了o3、Grok 4

谷歌拿下IMO金牌的模型Gemini 2.5 Deep Think已在Gemini App推出,速度更快、实用性更强。该模型仅对Ultra订阅用户开放,月费约1803元。其推理性能超o3、Grok 4,有迭代开发等优势。

量子位
算法论文8

颜水成领衔,给AI分段位!超100款多模态模型,无人达到L5

十所顶尖高校联合发布General - Level评估框架和General - Bench基准数据集,用五级分类制明确多模态通才模型能力标准。评估超100款模型,发现多数在L2 - L3,无L5模型,揭示当前模型不足。

新智元
新闻资讯7

阿里千问大模型换将,32岁林俊旸官宣告别

阿里巴巴高级算法专家、通义千问大模型负责人林俊旸宣布告别千问团队,此前一晚千问团队刚推出Qwen3.5轻量化模型且获马斯克点赞。此外,Qwen3.5核心贡献者Kaixin Li和通义实验室科学家Binyuan Hui也发文告别,几人去向未明。

量子位
新闻资讯8

腾讯AI战略大升级:组织架构重组与混元世界模型1.5发布

2025年12月17日,腾讯宣布两项重大举措,一是重组AI组织架构,成立新部门并任命首席AI科学家;二是发布混元世界模型1.5,能实时生成可交互3D虚拟世界,应用场景广泛,或引领行业进入‘AI原生’新阶段。

MCP Lab
新闻资讯8

还是谷歌懂程序员?Demis 采访首提“氛围编程”,Gemini 3 彻底戒掉“爹味”说教

谷歌连发产品,Gemini 3 余温未消又推出 Nano Banana Pro。Google DeepMind CEO Demis 与团队副总裁对话谈其细节,包括降低运行成本、调整“人设”、提出“氛围编程”,还认为 AGI 到来需 5 到 10 年及研究突破。

AI科技大本营
新闻资讯8

程序员不许写代码!OpenAI硬核实验:3人指挥AI,5个月造出百万行

OpenAI官博曝光内部实验,3人团队利用Codex智能体5个月造出百万行代码产品,人类不写代码,精力放于规划规则。此实验颠覆软件工程定义,宣告手工代码时代终结,也重塑程序员岗位。

新智元
产品应用8

Claude 4破解困扰人类4年系统bug,30年码龄程序员200小时没搞定,GPT-4.1/Gemini-2.5也做不到

30年码龄程序员4年没搞定的顽固型‘白鲸bug’,Claude Opus 4配合Code模式,用30个prompt+1次重启,几小时就破解。此前GPT - 4.1等模型都失败,凸显Claude编程与推理能力强。

量子位
算法论文7

大模型自信心崩塌!谷歌DeepMind证实:反对意见让GPT-4o轻易放弃正确答案

谷歌DeepMind携手伦敦大学研究发现,GPT - 4o、Gemma 3等大语言模型有“固执己见”和“被质疑就动摇”并存的冲突行为,原因与训练、决策逻辑、记忆机制有关。研究还通过两轮实验证实。

量子位
推荐文章7

AI窗口期只剩3-4年,98%的企业却高估了自身的技术成熟度

麻省理工学院报告显示,企业级AI试点仅约5%进入生产环节并产生回报。多数企业高估自身AI成熟度,落地难源于技术与组织发展速度不匹配。企业需系统重构,窗口期只剩3 - 4年。

AI前线
新闻资讯7

「摸鱼」被踢,GPT-4o真不行!30天筹款破万,AI真人秀太上头

AI Digest进行「智能体村庄」实验,4个AI为慈善筹款30天。Claude 3.7 Sonnet夺冠,GPT - 4o表现差被替换。实验展示AI多场景潜力,也暴露协作、应对复杂环境的局限。

新智元