「多任务」共找到 5353 篇相关文章
马斯克挖不动的清华学霸,一年造出 “反内卷 AI”!0.027B 参数硬刚思维链模型,推理完爆 o3-mini-high
新加坡 Sapient Intelligence 推出小型模型 HRM,参数仅 2700 万却能解决复杂推理难题,其不依赖“思维链”,借鉴人类大脑工作方式。该模型准确率超先进思维链模型,推理能力强,具经济性,可提升任务效率。
挤不动的世界机器人大会上,自变量秀出了真·通用具身智能
2025世界机器人大会上,自变量机器人展示多项成果。通用轮式双臂机器人“小量”“小白”能完成制作香囊、家务整理等任务;“量子2号”仿人形机器人动作精准自然;其具身智能基座模型WALL - A有强大泛化性。
长上下文不再难:KV Cache 全生命周期优化实战
长上下文大语言模型发展带来计算和内存挑战,现有基准测试多忽视 KV 缓存完整生命周期。微软姜慧强在 AICon2025 分享 SCBench 工具,梳理推理优化方法,介绍 MInference 等,还提出 Tri - shape 方法等成果。
Claude Opus 4.1模型发布,OpenAI继续被拉开差距
Anthropic发布Claude Opus 4.1模型,在各指标上超越Opus 4。Anthropic ARR达50亿美元,API收入首超OpenAI。新模型在多场景有进步,官网等渠道统一可用,还给出Claude Code使用建议。
别等GPT-5了!普林斯顿万字综述揭秘:我们要做自进化Agents!
普林斯顿大学联合多顶尖机构发表“自进化智能体”综述,描绘AI从静态工具演变成自我学习迭代智能体的过程,拆解其进化核心维度,介绍触发进化机制的时机、修炼方式及应用方向。
AI Agent平台Delve获3200万美元融资,估值3亿美元
21岁麻省理工辍学生创立的AI Agent安全合规平台Delve获3200万美元融资,估值3亿美元。它从医疗记录助手转型,业务扩展到多合规框架,用AI智能体自动化流程,但也面临竞争。
GPT-5实锤,悄悄上线代号「龙虾」!版本号曝光,实测编程惊人能改屎山代码
代号「龙虾」的神秘模型在WebDev Arena现身,网友猜测是GPT - 5,提前试用者称其编程能力惊人,能改屎山代码。多位用户表示其在代码生成等方面超越Claude,OpenAI或已秘密测试。
MeanFlow再下一城,北大提出机器人学习新范式MP1,实现速度与成功率双SOTA
北大研究团队提出机器人学习新范式MP1,将MeanFlow引入机器人学习,实现毫秒级推理速度。还引入分散损失提升少样本泛化能力,在仿真和真机测试中,实现速度与成功率双SOTA。
首钢园社群•邻里Station实战活动课:让AIGC掀起效率革命
7月16日晚,首钢园社群•邻里Station举办“AI视频生成与应用”实战活动课,聚焦AIGC前沿趋势。授课达人展示前沿AI平台案例,还进行多环节教学,剖析行业趋势,首钢园为学习实践提供好环境。
如何将LLM的"思考习惯"迁移到视觉领域?
传统多模态模型处理复杂视觉推理能力不足,OVR团队以Qwen2.5 - VL - 7B为基础构建开源强化学习框架,成果模型OVR在12个基准测试刷新记录,揭示认知行为跨模态迁移三条黄金定律。