「多任务能力」共找到 7351 篇相关文章
惊现高管离职潮!马斯克亲信操盘xAI,千亿美元能填AGI野望?
马斯克寄予厚望的xAI本月动荡不断,多位核心成员和高管离职,原因包括发展方向分歧和追赶对手的悲观情绪。高层震荡引发公司治理与财务争议,还出现裁员、实习生掌权等乱象,虽招聘但团队士气下滑。
AAAI 2026 Oral:明略科技开创稀疏数据「信息瓶颈动态压缩」,精度+速度双SOTA
在机器人和具身智能领域,transformer模型又大又‘重’,边缘设备难以承受。东南大学、中南大学、明略科技联合提出的CompTrack论文,创新性解决AI模型处理稀疏数据的‘双重冗余’,在3D点云跟踪任务上实现精度和速度双优。
Jev是分类器吗?今天向所有人开放,送1.2亿token
近期大火的Jev模型由TypeSafe AI推出,现已向所有用户开放,新用户可获得5美元额度约合1.2亿token。该模型主打快速结构化判断,引发AI社区热议,围绕其定位、能力优劣也有不少讨论与实测。
Sutton判定「LLM是死胡同」后,新访谈揭示AI困境
强化学习之父Rich Sutton直言LLM是死胡同,因其无法从持续实际互动中学习,违背他坚持的原则。在新访谈和圆桌讨论中,多位专家碰撞观点,探讨AI研究问题、强化学习困境及LLM发展走向等。
涌现之谜:AI如何像人一样思考与表达?
文章探讨AI如何像人一样思考与表达。早期自然语言处理受通用语法理论影响,但面对真实语言复杂性存在困难。人类经历第一次认知革命实现思维转变,AI也需足够大规模才能涌现复杂能力,“大”或是智能第一性原理。
爆冷!首届大模型争霸,Grok 4下出「神之一手」?DeepSeek、Kimi惨遭淘汰
谷歌Kaggle举办首届全球AI象棋争霸赛,八款顶级语言模型正面对抗。首战8进4淘汰战中,Gemini 2.5 Pro、o4 - mini、Grok 4、o3晋级,Claude 4 Opus、DeepSeek R1、Gemini 2.5 Flash和Kimi K2出局。比赛考验AI整体理解能力。
百度智能云 DuMate 测评:办公 Agent 教我用 Claude Code,效果如何?
百度智能云桌面级AI智能体DuMate于今年3月22日全量上线。本文对其进行测评,设计围绕GitHub项目的复杂任务,测试它在研究、整理、文件生成和展示化输出的表现,探讨办公Agent从内容提供商到办公搭子的转变。
算力稀缺时代,如何把 GPU 用“满”
在 GPU 稀缺且利用率低的背景下,本文分析其‘用不好’的原因,探讨业界共享技术方案的局限。以腾讯云 TencentOS qGPU 为例,解析内核态虚拟化及在离线混部技术,还介绍其在多行业降本增效的实践。
英伟达4B小模型击败GPT-5 Pro!成本仅1/36
英伟达ARC - AGI 2中,4B小模型NVARC以27.64%成绩力压GPT - 5 Pro登顶,单任务成本仅其1/36。亮点是零预训练深度学习法,还靠合成数据、测试时微调等策略。小模型特定领域优化后优势明显。
vivo AI Lab提出自我进化的移动GUI智能体,UI-Genie无需人工标注实现性能持续提升
香港中文大学MMLab和vivo AI Lab团队提出自我进化框架UI - Genie,构建奖励模型UI - Genie - RM解决轨迹验证难题,通过数据生成和模型迭代闭环实现智能体与奖励模型双向增强,在多基准测试中表现出色,打破人工标注瓶颈。