「多场景应用」共找到 6537 篇相关文章
高精度全身操控!从文本输入生成全身操控物体的动作
物体操控的整体动作生成是具广泛应用但极具挑战的任务,核心挑战在于手部与身体协调及关节式物体操控精度。香港大学提出协同扩散噪声优化框架CoDA,优化三个专用扩散模型,还采用BPS统一表示提高交互精度。
一个人+Claude+云服务,相当于一整个工程团队
网上两个实操演示被疯转,一是Google Cloud工程师用Claude配合Google云部署应用;二是Anthropic Claude团队教搭建带持久记忆的AI智能体。博主整理7天实操计划,将Claude变“全自动AI雇员”,还介绍多种AI雇员类型及成本。
当国产模型追上闭源旗舰,企业 AI 编程的真正障碍才浮出水面
过去企业AI Coding讨论多集中在模型能力等方面,DeepSeek V4出现缓解了模型问题,但更深层的代码库业务隐知识等问题浮现。合规限制使企业工具建设受阻,V4打破了模型供应瓶颈,可组织知识管理仍成难题。
独家|拿下5亿元海外订单,无界动力完成天使++轮融资,天使轮累计融资超2亿美元
AI科技评论独家获悉,通用具身智能机器人公司无界动力完成天使++轮融资,累计超2亿美元,天使+++轮也接近完成。其以隐空间世界模型构建具身大脑,区别于主流架构。还获远景超5亿订单,商业化落地成果多。
GTC 巅峰对话 Jeff Dean x Bill Dally:预训练范式已死、延迟瓶颈不在计算、谈透 AI 五年未来 | GTC 2026
GTC 2026上,NVIDIA首席科学家Bill Dally和Google Jeff Dean展开重磅对话。讨论了模型能力进步、低延迟推理架构、模型自主进化、数据与算力、训练与推理硬件差别等多方面内容,分享对未来AI的看法与见解。
Google 悄悄升级了 Deep Think,ARC-AGI-2 直接干到 84.6%
Google DeepMind 升级了 Gemini 3 的专用推理模式 Deep Think,跑分屠榜。ARC - AGI - 2 拿下 84.6%,在多个基准测试中表现优异。它不仅是解题机器,还能解决真实科学工程问题,已向部分用户推送,科研人员和开发者可通过 API 使用。
给AI打个分,结果搞出17亿估值独角兽???
大模型竞技场LMArena官宣拿下1.5亿美元A轮融资,估值升至17亿美元。它前身是Chatbot Arena,由LMSYS创建,核心成员多为顶尖高校学霸。LMArena评估规则有趣,成新模型必测榜单,计划用新资金运营平台、扩团队。
操控宇宙万物?Gemini3.0生成最火的3D粒子交互案例(圣诞老人、Jarvis)丨附HTML.代码
最近用Gemini 3.0或GPT 5.2做3D粒子交互爆火,能生成可手势操作的爱心、圣诞树等。以往需数天写代码,现在和AI对话几轮就行。文中给出基础提示词,还展示多个案例及HTML代码获取方式。
MOE RL实战:统一FP8全流程训练
SGLang RL团队等联合完成工作,实现RL中全流程FP8训练与采样。介绍FP8训练硬件基础、格式、scale选择等,指出训练难点,分析KL Loss异常归因,验证其在MoE模型RL应用效果,还探究模型规模对训推不一致性的影响。
分割一切并不够,还要3D重建一切,SAM 3D来了
深夜 Meta 重大更新,上线 SAM 3D、SAM 3。SAM 3D 含物体与场景重建、人体形状与姿态估计两模型,能将 2D 图转 3D 重建结果。SAM 3 可检测、分割与跟踪图像视频物体。Meta 开放模型权重与代码,推体验平台。