「使用场景」共找到 2988 篇相关文章
AI视频运镜玄学已破!告别无限抽卡,3D预演台直接封神
用AI做视频常遇运镜、人物走位等问题,因文生视频系统缺空间锚定能力。updream在8月17日上线「预演台」功能,通过传参考图自动生成3D白模场景,实测显示其显著减少「抽卡」次数。
给Claude Code装个电表,这个开源的ESP32仪表盘火了
Clawdmeter是开源的基于ESP32的桌面小仪表盘,能监控Claude Code使用额度和会话状态。它通过电脑端daemon获取信息,用BLE蓝牙发送到ESP32屏幕显示,功能丰富,还像桌搭玩具。
视频版Nano Banana来了!内置Gemini世界知识;原版香蕉出图仅需4秒
谷歌开放Gemini Omni Flash API,将多模态推理与视频生成编辑结合,有4项关键能力,也有局限。Nano Banana 2 Lite出图快且便宜。二者串联使用,图像生成与视频创作可无缝衔接。
LabVLA:当AI走进科学实验室,浙大x上海 AI Lab联合探索科学具身智能
浙江大学与上海人工智能实验室联合推出 LabVLA,探索更具泛化能力的科学具身智能范式。团队构建仿真数据引擎 RoboGenesis 与语料 LabEmbodied - Data,LabVLA 在多测试中表现良好,还将探索多场景应用。
更快更省!Vidu Q3硬核升级打响AI视频普惠第一枪 | 甲子光年
2026年AI视频行业内容产出增长迅猛,但成本上涨、生成慢等问题凸显。生数科技的Vidu Q3模型全面升级,生成速度提升5倍、价格降低,适配多场景,为AI视频普惠工业化提供范例。
只看图片就能学会压缩Token!浙大&阿里新框架多轮VQA压缩率90%,精度不掉|CVPR 2026
多轮视觉问答成LVLM推理效率“照妖镜”,现有压缩方法在多轮场景翻车。浙大宋明黎教授团队与阿里联合提出MetaCompress框架,可根据图像生成最优压缩映射,实验验证其效果优,能平衡压缩率与精度。
美国ATOM报告:Qwen称霸武林,中国统治开源世界
美国ATOM报告显示,2025年夏中国开源语言模型超美国,下载、使用量差距显著。Qwen成王者,DeepSeek在大模型领域表现出色。新势力如Nvidia、OpenAI等也在追赶,报告引入新指标衡量模型热度。
「OpenClaw之父点赞」终结百虾大战?一场升级版的AI原生革命上演
2026年科技圈“百虾大战”正酣,网易有道全量开源桌面Agent产品LobsterAI,获OpenClaw之父赞扬。有道还孵化多个Agent产品,重构底层逻辑,转变商业模式,深扎场景切片,探索“能力+订阅”范式。
史上最狠春节!阿里千问豪掷30亿,加入AI大战
阿里千问官宣“春节请客计划”,自掏30亿通过免单请全国人民吃喝玩乐。其依托阿里Qwen模型和丰富生态,介入生活场景能力强,此次活动或让AI从工具成消费决策默认选择。
腾讯云TencentOS智能运维平台TManager正式发布 | Q推荐
为满足企业运维需求,腾讯云推出 TencentOS Server 首款智能运维管理平台 TManager。它有 30 余项功能,能 AI 智能诊断,内部稳定运行多年,覆盖复杂场景,还赢得标杆客户信任,提升运维智能化水平。