「3D场景叙事系统」共找到 3464 篇相关文章
Google开源黑科技!不用训练的时间序列预测模型,17.9K Star 疯狂追捧!
Google Research团队开源的TimesFM时间序列预测模型获17.9K Star。它零训练、开箱即用,基于1000亿时间点预训练,涵盖多场景数据,还能给出置信区间,已集成到Google多个产品。
人大-清华-腾讯发布:音频 - 视觉多模态任务统一框架
人大、清华和腾讯合作发布Crab论文,目标是实现多模态场景理解任务的高效一统。它针对音频 - 视觉理解模型难点提出解决方案,构建数据集、设计LoRA结构、统一架构,训练分预训练和指令调整两阶段。
首个面向柔性衣物灵巧操作的仿真平台来了,北大、伯克利联合发布
北大和伯克利联合发布首个面向柔性衣物灵巧操作的仿真平台 DexGarmentLab。它基于 Isaac Sim 4.5.0 搭建,有多样化场景、自动化数据采集管线和泛化能力强的策略框架 HALO,可推动柔性物体操作应用。
从需求到设计到代码,一个软件全搞定!TRAE Work Design实测来了
TRAE Work上新Design模式,与Work、Code模式配合,实现需求、设计、代码全链路在一个平台跑通。它能识别提取设计系统,提供多种改图方式,且出图合规、改图顺手,还简化了工作流。
多模态 +Agent 在培训与教育领域的应用|QCon 北京
4月16 - 18日,QCon全球软件开发大会将在北京举办,聚焦Agentic AI等前沿话题。北银金科尹辰轩将分享《多模态 + Agent在培训与教育领域的应用》,探讨多模态模型推动AI场景扩充等内容。
Claude Agent Skills:从第一性原理深入剖析
本文深入剖析Claude的Agent Skills系统,它是基于提示的元工具架构,借助‘提示展开’与‘上下文改写’扩展大模型能力。文中以具体技能为例,介绍其机制、构建方法、编写规范及常见模式。
Kubernetes 引入后量子支持的 TLS
Kubernetes推出增强功能,通过与KMS插件系统集成的混合密钥交换机制支持后量子密码学,应对量子计算对加密协议的威胁,确保系统能随密码学标准演变灵活适应,此举措符合相关建议。
微软开源新版Phi-4:推理效率暴涨10倍,笔记本可运行
今天凌晨微软官网开源Phi - 4家族最新版Phi - 4 - mini - flash - reasoning,它参数小性能强,适合边缘设备。采用自研SambaY架构,推理效率涨10倍,延迟降2 - 3倍,多场景测试表现优异。
小展直击爆款毕设幕后!AI 能偷走人类的艺术灵魂?
最近AI绘画风很大,有人喊“人类要失业”,但郭奕彤带着《合成图像家庭》站出来打脸。他用碳笔勾勒‘毕加索版’大耳朵图图,让AI‘打辅助’,还给电视装‘随机盲盒’系统定制影像。
谷歌 AI Studio 实时视频对话终于支持中文了!屏幕共享+语音,Gemini 2.5 Flash 原生音视频加持。
谷歌AI Studio实时视频对话支持中文,有Gemini 2.5 Flash原生视频对话模型。使用方便,还提供多种音色,有让模型在无声时发音视频等功能,可用于设计、学习、修电脑等场景。