「分镜能力」共找到 3722 篇相关文章
统一框架下的具身多模态推理:自变量机器人让AI放下海德格尔的锤子
当前先进机器人无法像人类自如用工具,现有多模态系统有局限。自变量机器人提出端到端统一架构,以统一表示学习和多任务多模态生成解锁具身多模态推理能力,实现范式转换。
高考数学斩获139分!小米7B模型比肩Qwen3-235B、OpenAI o3
2025高考落下帷幕,人工智能领域多家大模型挑战数学卷。小米7B参数的MiMo - VL模型考139分,比肩Qwen3 - 235B、OpenAI o3,还在多方面表现出色,技术报告等已开源。
从高考到实战,豆包大模型交卷了
火山引擎原动力大会 Force 2025 发布豆包大模型 1.6 等多项新产品。豆包 1.6 性能提升,在多方面表现出色;Seedance 1.0 Pro 视频生成能力强。大会强调‘AI 云原生’,还推出多个套件和技术进展。
还得是华为!Pangu Ultra MoE架构:不用GPU,你也可以这样训练准万亿MoE大模型
华为盘古团队发布Pangu Ultra MoE模型架构与训练方法的中文技术报告。该模型全流程在昇腾NPU上训练,团队在架构和训练方法创新,实现准万亿MoE模型训练,还在多方面优化提升性能。
红杉中国推出 Agent 基准测试「xbench」,双轨评估体系,关注 AI 真实场景的效用
红杉中国开放AI和Agent基准测试工具「xbench」,采用双轨评估体系,构建多维度测评数据集。首期发布两个核心评估集并排名,提出垂类Agent评测方法论。该工具旨在解决现有评估问题,关注AI真实场景效用。
英伟达发布统一GPU开发平台DGX Cloud Lepton
英伟达发布专为开发者设计的AI平台DGX Cloud Lepton,可汇聚全球GPU计算资源,提供即时访问和无缝部署能力。它功能强大,支持多环境部署,提供统一体验,还有庞大合作网络。
打破56年数学铁律!谷歌AlphaEvolve自我进化实现算法效率狂飙,堪比AlphaGo“神之一手”
谷歌DeepMind联合顶尖科学家打造「通用科学人工智能」AlphaEvolve,打破矩阵乘法领域56年效率基准,将4x4矩阵乘法标量乘法次数从49次降至48次,还在谷歌内部加速了运算、缩短训练时间。文中介绍其原理与技术。
ChatGPT的记忆机制被公开了
OpenAI推出ChatGPT聊天历史记录记忆功能,默认关闭需手动开启,因未全面开放,技术大佬逆向工程破解机制。记忆系统分保存记忆、聊天记录等,体验反馈两极分化,有优势也有诸多bug。
LLM学习笔记:最好的学习方法是带着问题去寻找答案
文章总结拓展Andrej Karpathy教学视频,分析大模型聊天流程与原理,介绍LLM训练步骤,包括预训练、后训练和强化学习,还提及主流特性应用,如文件上传、网络搜索,强调带问题学习的重要性。
TikTok SRE 技术负责人:AI Agents 说到底就是分布式系统
本文整理自TikTok SRE技术负责人Salman Munaf的公开演讲,提出AI Agent具备调用外部服务、执行状态变更能力后,本质就是分布式系统,需运用分布式系统领域成熟经验规避风险、保障安全可靠。