GPT-5.3-codex」共找到 3929 篇相关文章

新闻资讯8

刚刚,Gemini 2.5 Pro升级,成编程模型新王

Google DeepMind发布Gemini 2.5 Pro (I/O edition),编程能力大幅提升,在编程排行榜超Claude 3.7 Sonnet。用户用一个提示词或草图+描述就能构建应用,谷歌大佬站台,网友实测效果佳。

机器之心
新闻资讯8

两张图定位全球,o3碾压T0级高手!人类「诡计」被看穿,跨模态推理爆表

OpenAI的o3在GeoGuessr游戏中与大师级玩家Sam Patterson对决,o3通过视觉与搜索推理,忽略伪造EXIF信息,最终以23179比22054获胜,展现出跨模态推理潜力,引发对AI推理能力的思考。

新智元
产品应用7

混元 Hy3 发布:99% 的任务,够用了

腾讯混元模型 Hy3 正式上线,免费使用两周。它是快慢思考融合的 MoE 模型,主打 Coding 和 Agent 场景,性价比高。作者用它做了多项测试,如制作 PPT、开发代码、舆情分析等,还与 GLM - 5.1 对决,表现不错。

AGI Hunt
新闻资讯7

陶哲轩:用了GPT-5 Pro后,小尺度、宏观尺度很赞,中尺度有点垮

著名数学家陶哲轩用ChatGPT - 5 Pro研究曲率有界的球面问题,记录AI在不同层面的表现。小尺度和宏观尺度AI有用,中尺度帮助有限。虽问题未解决,但他学到新知识,也意识到与AI协作要谨慎。

机器之心
新闻资讯8

谷歌Gemini 3.2偷跑上线!2200行代码一镜到底,Claude/GPT坐不住了

发布会未开,谷歌Gemini 3.2 Flash网页端静默上线,编码实力强悍,代码量大幅提升。其核心技术是蒸馏与稀疏化,推理成本大降。Gemini App集成第三方应用,谷歌I/O大会多款产品将曝光,此次发布对谷歌至关重要。

新智元
新闻资讯8

Claude Opus 4.5来了:谷歌把Anthropic逼到了墙角

上周谷歌发布Gemini 3 Pro表现惊艳,今日Anthropic推出Claude Opus 4.5应对。其编程能力强,SWE - bench Verified首超80%,且降价66%。还推出产品更新,开发者可按需选模型。

花叔
开源动态8

准确率92.7%逼近Claude 3.5、成本降低86%,开源代码定位新神器LocAgent来了

OpenHands 等团队发布 LocAgent,这是用于代码定位的图索引 LLM Agent 框架,准确率达 92.7%。它把代码库解析成图,提供工具接口,经实验效果出色,开源微调模型降本增效,还能提升问题解决率。

机器之心
算法论文7

最新发现!每参数3.6比特,语言模型最多能记住这么多

Meta、DeepMind等团队研究语言模型记忆容量,提出新方法估计模型对数据点的‘了解’程度,发现GPT系列模型约每个参数3.6比特,还提出模型容量等相关定律,激发社区多方面思考。

机器之心
开源动态8

Mistral 3开源,一举超越DeepSeek与K2?

近期,Mistral AI开源Mistral 3,含三款小型稠密模型及Mistral Large 3。Benchmark对比中,它领先国内DeepSeek - 3.1、Kimi - K2。Mistral Large 3是强开源权重模型,Ministral 3适合边缘端,成本性能比低。

PaperAgent
产品应用8

3B激活参数!商汤绝影Sage登顶PinchBench,端侧第一

商汤绝影Sage端侧大模型在PinchBench评测中,以94%任务完成率超越Claude、GPT - 5.4等主流大模型。它激活参数仅3B,算力需求低,还具备多项实用场景能力,靠SCOUT和ERL两项自研技术提升性能。

新智元