GPT - 5.3 - codex」共找到 3929 篇相关文章

算法论文8

规范对齐:回答前的深思,让安全与行为边界更清晰

OpenAI等厂商将规范融入大模型。上海交大等团队提出规范对齐概念,构建评测基准SpecBench,揭示主流模型不足。探索测试时深思方法,如Align3,能提升模型规范遵循度,项目已开源。

深度学习自然语言处理
算法论文7

AI在「赚钱锦标赛」夺冠,比人类还会做生意!躺赚时代要来了?

研究人员提出自动售货机运营模拟环境Vending - Bench,测试大模型智能体管理业务能力。实验显示不同大模型性能方差大,Claude 3.5 Sonnet净资产表现最佳,人类基线在可靠性上表现较好,各模型长周期表现波动大。

新智元
新闻资讯8

诺奖得主刚走,Gemini两大核心叛逃Anthropic!

谷歌人才流失严重,一周内五名顶级研究员出走,Gemini两大核心将入职Anthropic。同时,Gemini 3.5 Pro延期至7月。Alphabet股价下跌,市值蒸发超2000亿美元。原因或是上市期权诱惑和算力分配问题。

新智元
开源动态8

阿里Qwen悄悄放出6个开源权重,国庆卷疯了~

国庆期间,阿里通义千问悄悄放出6个开源模型权重,Qwen3-VL是通义千问系列最强大的视觉 - 语言模型。其30B版本多模态表现媲美GPT - 5 - Mini等,功能与架构均有升级。

PaperAgent
新闻资讯7

OpenAI史上最大失误:放走这位MIT学霸!美国AI「三朝元老」,现实韦小宝

AI时代算力竞赛正酣,Anthropic联合创始人Tom Brown称其规模超阿波罗与曼哈顿计划。他曾在OpenAI参与打造GPT - 3,后与团队决裂创立Anthropic,推出Claude并获市场认可,还分享了对年轻人的建议。

新智元
算法论文8

多模态推理新范式:上海AI Lab新作证明“画”出答案比“说”出答案更靠谱

上海人工智能实验室等联合提出DiffThinker模型,利用扩散模型构建全新视觉推理范式。它在视觉中心任务上表现优异,准确率碾压GPT - 5等模型,还能与MLLM协同推理实现1 + 1 > 2的效果。

深度学习自然语言处理
算法论文8

协同加速,多机器人协作不再「慢半拍」!软硬一体化框架ReCA破解具身智能落地效率瓶颈

佐治亚理工学院等团队推出集成加速框架 ReCA,针对多机协作具身系统,从算法、系统、硬件跨层协同优化,经评估,实现 5 - 10 倍速度提升且成功率升 4.3%,为具身智能落地奠基。

机器之心
新闻资讯7

AI圈水太深:OpenAI保密、Meta作弊!国产MoE却异军突起

文章梳理大语言模型发展,从传统稠密架构到稀疏MoE架构,参数从百亿到万亿。介绍OpenAI、Meta等厂商模型,如GPT系列、Llama系列,还提及Mixtral、DeepSeek V3等。指出Meta作弊丑闻,国产MoE模型异军突起。

新智元
新闻资讯7

OpenAI头号叛徒,竟然是自学的AI???

Anthropic联合创始人Tom Brown分享AI奋斗史,他大学线性代数仅B-,自学6个月AI后进入OpenAI,后与前同事创立Anthropic。Claude 3.5 Sonnet让其有与OpenAI竞争底气,市场份额反超,还对OpenAI多番反击。

量子位
开源动态8

LeCun预言成真!790年长视频,炼出最强开源「世界模型」

2025年‘世界模型’成AI巨头战场,谷歌、李飞飞团队等纷纷布局。上周北京智源研究院发布Emu3.5,340亿参数,基于790年长视频数据训练,其架构优越,推理快,能力强,还公开技术报告邀全球探索。

新智元