测试时强化学习」共找到 2995 篇相关文章

算法论文8

北大、字节、中科院自动化研究所等提出图像并行生成新范式

北大、字节等团队发现多模态模型先思考后作画会降低图像语义保真度,因自回归架构有误差传播问题。为此提出并行多模态扩散框架MMaDA - Parallel,构建ParaBench基准,多项优化后在测试中击败Bagel。

AIGC开放社区
产品应用8

刚刚,Cursor 2.0携自研模型Composer强势登场,不再只做「壳」

Cursor 2.0发布重大更新,带来自研编码模型Composer和新协作界面。Composer速度领先,针对软件工程优化;新界面以智能体为中心,可并行运行多智能体,还解决了代码评审和测试瓶颈。

机器之心
产品应用8

比Qwen3-Max更Max?夸克抢先用上最新闭源模型

10月23日夸克上线对话助手,采用比Qwen3 - Max更优的Qwen最新闭源模型,实现AI搜索与对话深度融合。经测试其搜索、理解、写作等能力出色,技术架构创新,是阿里‘模型即应用’战略体现。

机器之心
新闻资讯7

马斯克:Grok 5 将实现真正的 AGI

Vending Bench测试中,xAI的Grok 4以近两倍销售量和31%高收益击败GPT - 5,展现惊人稳定性。马斯克却称Grok 5有机会成真正AGI,引发网友各种反应,Grok 4虽领先但也有争议。

AGI Hunt
新闻资讯8

斯坦福意外用AI生成超强CUDA内核,性能比人类专家优化得还要好!翻倍碾压原生PyTorch,华人主创

斯坦福团队意外发现AI生成的内核性能超人类专家优化的,在常见深度学习操作上能让性能提升近400%。其方法是生成自然语言优化思想再转化为代码,还使用多分支探索模式。

量子位
新闻资讯7

AGI倒计时,OpenAI首席研究官重磅表态:留给人类的窗口「很小」

OpenAI首席研究官Mark Chen称AGI即将到来,模型能自主研究。他反对‘预训练已死’,认为Scaling曲线未到头。还提出‘Vibe Researcher’概念,不过通往AGI有评测和持续学习等问题待解决。

新智元
新闻资讯7

英伟达把8个AI和8台机器人关在一起,它们学会了自己做实验

英伟达高级研究科学家公布“ENPIRE”项目,8个AI与8台机器人组成科研团队,能自主做实验。研究测试三种coding agent,Codex表现最佳。系统分两阶段,虽有局限但有新发现。

DeepTech深科技
产品应用7

揭秘与评测 30K+ Star 的 Graphify:企业存量系统 AI 编码的"第二大脑"。

文章揭秘评测 30K+ Star 的 Graphify,它能将分散材料转为结构化知识图谱,助 AI 编程助手理解代码。介绍其使用方法、原理,经测试它能提升综合质量、降低探索成本,不过并非万能解药。

AI大模型应用实践
新闻资讯7

天塌了,Pro用户用不了Claude Code,除非100美元买Max

Anthropic 悄悄修改价格页面,将 Claude Code 从 20 美元 Pro 套餐剔除,变为 100 美元 Max 套餐专属。开发者反应激烈,官方称是针对 2% 新用户的定价测试,OpenAI 借机拉踩,网友质疑,开发者开始物色下家。

机器之心
新闻资讯7

Claude强到不敢发的Mythos,被质疑用了字节Seed技术

Claude最强“神话”模型Mythos引发猜测,或用了字节Seed技术。社区热议其是否采用循环语言模型架构,关键线索来自Anthropic测试数据,在图搜索测试中Mythos优势明显,还有其他线索指向循环架构。

量子位