双模式推理」共找到 2627 篇相关文章

算法论文8

西湖大学张驰团队:从视觉合成到空间理解,视频 AI 正在「转向」丨CVPR 2026

过去两年视频生成发展近成熟,但多数模型缺乏空间结构稳定建模能力。西湖大学AGI Lab团队提出论文,将问题落回推理阶段,让相机轨迹成约束条件,推进视频生成到三维结构约束建模。

AI科技评论
算法论文8

首个用户生活「长程模拟器」来了!LifeSim 重新定义大模型个性化评测

现有个性化助手评测基准与真实用户-助手交互脱节,来自复旦大学等的研究人员提出 LifeSim 框架及 LifeSim-Eval 评测方法。实验显示主流 LLM 处理显性需求尚可,隐性意图识别等方面短板明显。

机器之心
新闻资讯7

Claude最新模型Mythos意外泄露,性能远超Opus

Anthropic内容管理系统配置失误,近3000个未发布资产泄露,Claude最新模型Mythos提前公开。它在软件编码、学术推理和网络安全等测试中远超Opus,网络安全能力尤其危险。2026年初Anthropic产品密集发布。

开源AI项目落地
算法论文8

刚刚,英伟达革了自己的命:智能体自主进化7天,干掉所有算子工程师、GPU专家

英伟达新研究AVO构建了新型进化变异算子,用自主编码智能体取代经典方法。智能体7天自主进化,优化MHA内核,性能超cuDNN和FlashAttention - 4,还能快速适配GQA,展现强大泛化能力。

机器之心
产品应用8

安谋科技Arm China“玲珑”VPU IP来了!瞄准这些应用场景

安谋科技Arm China推出面向AI应用的新一代VPU IP——“玲珑”V560/V760。该产品性能硬核,是“六边形战士”,集高性能、高鲁棒性等六大特性于一身,已完成首批客户授权,助力AI时代视频处理。

芯师爷
算法论文8

迈向原生全模态AI智能体:人大&小红书发布OmniGAIA新基准

中国人民大学等团队推出 OmniGAIA 新基准及 OmniAtlas 训练框架。OmniGAIA 含 360 个高难度任务,覆盖多领域。实验显示闭源与开源模型差距大,OmniAtlas 显著提升开源模型表现,并指出未来全模态智能体发展方向。

PaperAgent
算法论文8

Nature子刊:攻克医疗器械「看不清」难题,赋予自动驾驶视觉

MicroSyn-X首创无需真实数据的AI合成影像技术,让机器在无标注虚拟X光中学会追踪微型手术器械,突破医疗数据稀缺瓶颈,为自动化微创手术提供新路径,且代码和数据已开源。

新智元
新闻资讯7

跳出英伟达生态:OpenAI 发布新编程模型 GPT-5.3-Codex-Spark,速度达 1000 token每秒

OpenAI 发布新编程模型 GPT-5.3-Codex-Spark,跑在 Cerebras 晶圆级芯片上,速度达每秒超 1000 个 token,比传统 GPU 推理快约 15 倍,这是其跳出英伟达生态的里程碑。

AGI Hunt
算法论文8

华为发布业界首个扩散语言模型Agent,部分场景提速8倍!

华为等团队研究发现,把Agent“底座”换成扩散大模型(DLLM),执行速度提升30%以上,部分复杂任务效率达传统AR模型8倍。其优势源于生成范,可重塑Agent设计。

量子位
产品应用7

Qwen3满血版上线,第一件事就是把搜索按钮干掉了。

Qwen3-max满血版发布,去掉搜索按钮,因模型能力提升无需手动控制。它具备自适应工具调用能力,能自行判断何时使用搜索等工具,思考过程结构化,跑分接近一线模型。

探索AGI