「团队落地」共找到 4324 篇相关文章
老黄刚投的具身智能公司:三个华人创办
Dyna Robotics获1.2亿美元A轮融资,英伟达是新晋股东。该公司由三个华人创立,决定先将具身AGI带入商用场景,今年4月发布可落地商业场景的灵巧操作基础模型DYNA - 1,已在多场景应用。
新鲜出炉!谷歌nano banana模型刷屏背后技术揭秘
谷歌Nano Banana模型刷屏,其项目负责人等揭秘技术。它有场景一致性、文本渲染等特性,团队用文本渲染能力作评估指标,还靠原生多模态、交错式生成等技术,结合用户反馈实现多方面进步,图像模型做PPT尚处起步。
Meta提出Deep Think with Confidence:几乎啥都不用动,就能提升推理的准确性与效率
传统自一致性方法虽能提升推理准确率,但计算开销大、收益递减。Meta AI与UCSD团队提出Deep Think with Confidence(DeepConf),可在不增训练成本和不调超参数下,提升推理准确性与效率,本文对其全面解读。
让AI像人类一样认知真实世界!UCLA谷歌强强联手,长时记忆+3D空间理解超越基线16.5%
如何让AI在3D环境中像人类一样思考,是具身智能领域难题。UCLA与谷歌团队带来3DLLM - MEM模型与3DMEM - BENCH基准,让AI有构建、维护和利用长时记忆能力,实验超基线16.5%,但有依赖模拟器预设的局限。
智能体时代的强化学习:AReaL 框架与 Agent 最佳实践
本文整理自吴翼博士在 2025 年 QCon 全球软件开发大会的分享。他介绍 AReaL 框架及 Agent 最佳实践,阐述强化学习与大模型联系,指出 Agent 是 AGI 未来 5 年关键,强化学习是 Agent 技术核心,还分享团队成果与经验。
这些大神在Meta的论文看一篇少一篇了
田渊栋团队剖析可验证奖励强化学习(RLVR)训练动态,戳破参数更新稀疏误区,提出三门理论说明其参数更新定位机制,还为RL训练算法设计提供指导,指出SFT时代参数高效微调方法在RLVR中迁移效果差。
Unsloth发布Qwen3-VL本地运行和微调指南,修复隐藏bug
Unsloth团队修复Qwen3-VL系列模型聊天模板语法问题,重新上传GGUF量化文件,使模型可本地稳定运行。介绍了不同规格模型硬件需求、表现,给出部署步骤、参数差异,还展示多模态能力测试,提供多种格式模型及微调工具。
IDC 最新AI Infra报告解读|AI 云爆发的背后:AI 应用全球化势不可挡
近期 IDC 发布报告,显示亚太企业 GenAI 应用增长快,AI 产业从开发到应用落地。这催生 AI 原生云,GMI Cloud 等新兴厂商崛起。同时,企业面临算力管理成本高问题,推理需求重塑市场格局,为中企出海带来机遇。
让大模型学会“像人一样”查证真伪
伊利诺伊大学香槟分校等校研究团队提出训练框架Veri - R1,为大模型提供“在线查证”新范式。它借助在线强化学习、精细化奖励机制和高质量数据,让模型学会像人一样查证,在多数据集上表现出色。
突破LLM数据瓶颈:Meta等提出语言自我博弈,一台模型,两个角色,无限进化
Meta等团队提出“语言自我博弈”(LSP)框架,让语言模型自己和自己“玩游戏”,在无外部数据输入下自我改进。实验显示,其性能可媲美甚至超越用大量人类数据训练的模型,为缓解数据稀缺提供新思路。