全栈自主」共找到 2364 篇相关文章

算法论文8

腾讯混元 TurboS 技术报告首次公开:560B 参数混合 Mamba 架构,自适应长短链融合

日前腾讯混元 TurboS 技术报告公开。它是超大型 Hybrid Transformer - Mamba 架构 MoE 模型,有自适应长短思维链机制,总参 560B。在多榜单成绩亮眼,多语种和多任务处理能力强,还介绍了核心创新、训练策略等。

InfoQ
算法论文8

一个省略号提示+强化学习搞定大模型“过度思考”,中科院自动化所新方法:从强制推理到自主选择

中国科学院自动化研究所联合鹏城实验室提出AutoThink方法,用省略号提示和多阶段强化学习,让推理大模型依题目难度自主切换思考模式,解决过度思考问题,在多数据集验证有效。

量子位
新闻资讯7

AI圈两件大事,Meta超级智能实验室大规模裁员,OpenAI新发布的浏览器遭网差评。

近期AI圈热闹非凡。Meta超级智能实验室裁员600人,包括资深人员田渊栋,或因前期扩张致团队臃肿。而OpenAI新发布的浏览器Atlas仅Mac版,口碑差,功能不新鲜,产品成熟度和体验欠佳。

开源AI项目落地
新闻资讯7

是套路!英伟达千亿美元投OpenAI,奥特曼拿钱买卡还让甲骨文赚差价

英伟达计划向OpenAI投资最高1000亿美元,OpenAI要用这笔钱构建至少10GW的AI数据中心,用英伟达系统。首笔100亿预计2026年下半年投入。此外还存在甲骨文参与的“三角财富循环”。

量子位
产品应用7

高考数学卷重赛!一道题难倒所有大模型,新选手Gemini夺冠,豆包DeepSeek并列第二

因网友质疑上次测评不严谨,此次用六款大模型挑战含解答题的套高考数学题。结果Gemini 2.5 Pro夺冠,Doubao和DeepSeek R1并列第二。解答题是失分重灾区,图像题难倒多模态大模型。

机器之心
新闻资讯8

阿里一口气发了N款新模型,让我们向源神致敬。

阿里云栖大会发布众多模型,有Qwen3 - Max、Wan2.5等。Qwen3 - Max对标顶尖模型;Wan2.5支持音画同出;Qwen3 - VL是强大视觉语言模型且已开源;Qwen3 - Omni是模态模型。此外还有多个新模型,构建场景生态。

开源星探
算法论文8

“掩码即武器”,四款扩散LLM部破防 ? 上交&上海AI Lab发现dllm致命安缺陷

上海交通大学、上海人工智能实验室等团队研究指出,扩散语言模型(dLLMs)有根本性架构安缺陷。他们提出DIJA攻击框架,能让多个dLLMs大概率生成有害内容,还呼吁从多方面加强dLLM安

深度学习自然语言处理
算法论文8

Qwen&清华团队颠覆常识:大模型强化学习仅用20%关键token,比用部token训练还好

Qwen与清华LeapLab团队研究发现,大模型强化学习训练推理能力时,仅20%高熵token就能撑起效果,甚至超部token训练。团队用此在Qwen3-32B创造新SOTA记录,还探讨了强化学习的相关特性。

量子位
新闻资讯8

168小时AI狂写300万行代码造出浏览器!Cursor公开数百个智能体自主协作方案

Cursor创始人公布实验结果,让数百个AI智能体跑一周,从零造出可用Web浏览器,产出超300万行代码,项目源码已公开。此次实验靠GPT - 5.2 - Codex,还设计了智能体协作架构,引发业界讨论。

量子位
产品应用8

奥特曼重磅发声:AI公司是未来!OpenAI官宣Frontier,让管理Agent像管人一样简单

OpenAI推出智能体中枢平台Frontier,可整合企业系统与数据,让智能体稳定运行。目前Anthropic在企业级大模型市场份额领先,OpenAI想借Frontier卡位。该平台已获多家巨头试用,有望拉开AI扎根企业核心业务时代序幕。

InfoQ