GPT - 2 XL」共找到 2722 篇相关文章

算法论文8

让LLM扔块石头,它居然造了个投石机

港中大研究团队带来《Agentic Design of Compositional Machines》,推出BesiegeField平台,支持并行实验和大模型‘自我进化’。它将机械设计转为语言生成任务,通过闭环训练提升模型能力,多个模型测试表现良好。

量子位
新闻资讯7

奥特曼:点名表扬两个波兰人,OpenAI还没遇到过他们解决不了的问题

奥特曼点名表扬OpenAI两位波兰科学家Jakub Pachocki和Szymon Sidor,他们贡献从Dota项目扩展强化学习到领导GPT - 4预训练。2023内乱中他们追随奥特曼,后帕哥成首席科学家,西哥为独立贡献者。

量子位
新闻资讯7

「纳米香蕉」LMArena两周500万投票,引爆10倍流量!谷歌、OpenAI扎堆打擂台

8月,「纳米香蕉」登顶LMArena文生图像榜单,带动社区流量暴增10倍,月活超300万。其盲测两周吸引超500万次投票。LMArena前身是Chatbot Arena,为大模型提供比拼舞台,厂商借此获曝光和反馈。

新智元
新闻资讯7

刚刚,大模型棋王诞生!40轮血战,OpenAI o3豪夺第一,人类大师地位不保?

国际象棋积分赛成果出炉,OpenAI o3以人类等效Elo 1685分夺冠,Grok 4和Gemini 2.5 Pro紧随其后。Kaggle发布国际象棋文本排行榜,评估模型战略推理等能力,还推出相关数据集,虽有局限但意义重大。

新智元
新闻资讯7

OpenAI华人露头就被小扎挖!95后北大校友1个月前上直播,今天已是Meta人

OpenAI华人工程师露脸易被Meta挖角,此次主角是95后北大校友孙之清,他刚参与ChatGPT Agent发布直播就加盟Meta。此前Jason Wei等也被挖,网友调侃让奥特曼别让亚洲面孔上直播,OpenAI也在加强人才保护。

量子位
算法论文8

追剧不断网,可能背后有个AI在加班,故障诊断准度破91.79%

中兴通讯和中国移动团队针对电信网络故障诊断难题,提出 TN - RCA530 基准和 Auto - RCA 框架。测试多个大模型,初始准确率低,经框架优化后,Gemini - 2.5 - Pro 准确率从 58.99% 升至 91.79%,超人工水平。

机器之心
开源动态8

北大、字节跳动联手发布SWE-Swiss:一把修复代码Bug的「瑞士军刀」,完整配方直指开源SOTA

北大、字节跳动等联合研究提出SWE - Swiss配方,用于训练解决软件工程问题的AI模型。32B参数的SWE - Swiss - 32B在SWE - bench Verified上准确率达60.2%,各训练环节效果显著,模型和数据将开源。

机器之心
产品应用8

特工现场实录|纳米 AI 如何构建 L4 蜂群系统?

纳米AI更新发布L4级多智能体蜂群系统,将“协作”能力写入Agent系统底层。该系统采用三层架构管理运行逻辑,通过协作空间与A2A通信协议配合,实测稳定性佳。平台降低开发门槛,后续规划聚焦多方向。

特工宇宙
算法论文8

密室逃脱成AI新考场,通关率不足50%,暴露空间推理短板丨清华ICCV25

清华大学团队受密室逃脱游戏启发,提出EscapeCraft:一个3D密室逃脱环境,用于评估多模态大模型在视觉环境中完成复杂任务推理的能力。该论文已入选ICCV 2025。研究评测了多个热门模型,发现它们在推理和探索行为方面存在诸多问题。

量子位
开源动态8

最强3B「小钢炮」,代码数据全公开!推理随意开关,128k超长上下文

Hugging Face推出30亿参数模型SmolLM3,支持128k长上下文,训练等全链路开放。它在架构、数据混合策略等多方面优化,性能超Llama3.2 - 3B等,还公开双模式指令模型构建方案。

新智元