「多任务并行」共找到 5386 篇相关文章
AI还不会独自问诊,o3准确率仅为51.12%,上交大×SII开源高难度复杂疾病诊断测评集
上海交大与SII团队开源高难度复杂疾病诊断测评集DiagnosisArena。测试显示,现有大模型在复杂临床诊断任务中表现不佳,o3准确率仅51.12%,且选择题设置无法反映其真实能力。
GPU荒还没结束,CPU可能要被抢起来了
2026 年英伟达宣布量产为 AI 智能体打造的 CPU Vera。此前 AI 产业硬件焦虑多围绕 GPU,如今 AI Agent 改变任务形态,CPU 负担加重,芯片厂商纷纷布局,产能变化或让消费者买单。
RoboScience 机器科学发布轮式仿人形通用机器人 REX G1,让机器人真正成为新一代具身生产力伙伴
8月17日,RoboScience机器科学发布轮式仿人形通用操作机器人REX G1,定位“新一代具身智能生产力伙伴”。它搭载自研VLOA架构通用具身大模型Visics,适用于多场景,推动机器人承接完整任务。
马斯克4000亿布局Agent :杀死 Cursor,Bot 有什么绝招?
马斯克花600亿美金买下AI编程产品Cursor俩月后,SpaceXAI发布Grok Bot。它定位特殊、可跨应用操作等,亮点是多智能体云端协作,但产品力与生态有差距,定价高端。
Qwen3.8-Max:编程与办公,全面跃升
今日正式发布Qwen3.8-Max,下周将开源其及Qwen3.8 - 27B模型权重。它参数达2.4万亿,在多方面全面提升。开发者可通过千问AI平台获API服务,性价比高。在编程、办公等场景表现出色,用户反馈良好。
万帧照片级仿真,打通视觉机器人学习的感知与物理鸿沟:国产仿真器GS-Playground入选RSS 2026
清华大学等联合提出高通量视觉高保真仿真器GS - Playground,被RSS 2026录用。它解决现有仿真器渲染开销高、资产制作依赖人工、Sim2Real迁移鸿沟大等问题,是全栈重新设计的仿真基础设施。
拒绝Reward Hacking!港科联合快手可灵提出高效强化学习后训练扩散模型新范式
使用强化学习微调扩散模型时,常面临Reward Hacking和KL正则化阻碍探索收敛的问题。港科等团队提出GARDO框架,通过门控自适应正则化和多样性感知优化,解决痛点且全面开源。
内存直降50%,token需求少56%!用视觉方式处理长文本
在NeurIPS 2025论文中,南京理工大学等校研究团队提出VIST框架,为大语言模型长文本高效推理提供视觉解决方案。它模仿人类阅读机制,让模型具备选择性阅读能力,减少Token需求和内存使用。
谷歌量子计算重磅突破登上Nature:首次实现可验证量子优势,比最快超算快13000倍
谷歌量子AI团队宣布里程碑式算法突破,其Willow芯片运行“量子回声”算法,首次在硬件上实现可验证量子优势,执行特定任务比最快超算快13000倍,为多领域应用铺平道路。
Chrome已死,Agent当立。 AI Chrome正式发布~
谷歌官宣为Chrome浏览器植入Gemini AI,发布10项更新,如智能体助理上线、跨标签页整合等。但用户体验不稳定,其AI能力是嫁接非原生。创业公司可放弃浏览器,拥抱智能体,利用自身优势发展。