「复杂任务」共找到 2539 篇相关文章
MiroMind新模型超越GPT-5.4,三位顶尖AI科学家加盟
MiroMind发布MiroThinker - v1.7模型家族,在深度研究任务中表现出色,其专有智能体MiroThinker - H1超越多个顶级闭源模型。同时,三位顶尖科学家加盟,分别负责推理模型训练等方向,公司聚焦推理与可验证性。
五百行代码打造SOTA视觉智能体!UniPat AI最新开源
多模态大模型代码能力强,但基础视觉任务常失误。UniPat AI推出极简视觉智能体框架SWE-Vision,让模型用代码弥补视觉短板,在五个主流视觉基准测试达最优。该框架设计独特,开源代码和数据已发布。
CVPR 2026|清华联合美团推出3DThinker,首个用3D意象思考的工作
当前多模态大模型在空间理解任务表现弱,缺乏对几何信息提取能力。清华联合美团推出3DThinker,无需3D标注和外部工具,让模型内蕴‘想象’三维场景,在多基准上提升效果,且具备一定可解释性。
李飞飞World Labs最新判断:AI写完代码,下一步是「写世界」?
这篇来自 World Labs 的博客探讨了 AI 参与空间创作和现实世界任务时的通用接口,认为是 3D 。它像代码一样可结构化表达,还分析了神经图形学、模拟引擎的作用,并介绍了相关项目。
人类开发者将消失?斯坦福等打破自动编程神话,回到以人为本
AI编程发展使人们认为人类开发者将消失,但卡内基梅隆等大学研究者提醒,当前AI编程研究陷入追求机器全自动解决任务的怪圈,应转向以人为本,还提出构建人机协作的四大支柱及升级基础设施等建议。
微软放话一年消灭白领!硅谷老板流行借助AI亲自上手一切
微软AI掌门人苏莱曼称12到18个月内,电脑前工作将被AI自动化,会计等白领岗位首当其冲。硅谷CEO用AI写代码、搭产品抬高绩效标准。不过现实复杂,AI红利多在科技圈,岗位替代没那么快。
蚂蚁出手VLA,就是开源超越Pi0.5的基座模型
当前具身智能落地面临泛化能力不足的挑战,蚂蚁灵波开源发布的基座模型 LingBot-VLA 带来突破。它基于大量真实世界数据预训练,在多项真机任务测试中超越 Pi0.5,且在架构、效率等方面有创新。
万字长文|迈向电商大模型时代,从虚拟试穿聊到电商AIGC
本文是京东李岩博士在AICon2025的演讲整理。他从虚拟试穿切入,拆解其技术逻辑、行业实践与未来趋势,还介绍京东电商AIGC布局,如商品抠图、素材生成等能力,分享业务成果及对电商AIGC未来的看法。
“大模型第一股”打响上市前哨战!智谱GLM-4.7 刷新开源编程SOTA,修复代码、终端操作表现超Claude 4.5
冲刺大模型第一股的智谱推出开源大模型GLM - 4.7,主打编程与代理式任务提升。它在多项基准测试中表现出色,UI质量飞跃,还采用新推理机制。智谱上市在即,但亏损扩张快,研发投入大。
ENG APPL COMP FLUID | 西北工业大学曹文博、张伟伟等:基于参数化神经网络求解器的层流翼型绕流代理模型
近年来,PINNs在流体力学中受关注,但在高维参数化与复杂流动问题中受限。西北工业大学曹文博团队基于TSONN构建层流翼型绕流参数化求解器,训练出强泛化能力的代理模型,为工程层流气动分析提供新方案。