「腾讯混元团队」共找到 3788 篇相关文章
腾讯重磅开源!端到端视频音效生成模型HunyuanVideo-Foley
腾讯混元正式开源端到端视频音效生成模型 HunyuanVideo-Foley,适用于多场景。它采用新型框架结合 REPA 策略,有三大核心优势,能适配多种场景,抑制底噪,保证音频保真度。
实测腾讯首个 AI IDE 产品,小白也能『批量开发』微信小程序
2025年AI Coding领域竞争激烈,腾讯7月22日揭幕国内首款“产—设—研”全链路AI IDE CodeBuddy。它支持主流模型,能将想法转化提示词等,通过多个案例展示其强大功能,腾讯还计划让其普惠开发者。
众所周知视频不能P?北大施柏鑫团队、贝式计算CVPR研究:视频里轻松换衣服、加柯基
视频编辑难度高,传统流程繁琐,现有AI方法有局限。北大施柏鑫团队联合贝式计算等提出VIRES方法,能实现视频主体多种编辑操作,还标注VireSet数据集。其在多指标超现有SOTA模型,团队还探索全景级可控视频生成。
0行人类代码!OpenAI内部绝密实验曝光:3人团队5个月砸出百万行级产品
OpenAI工程团队进行内部实验,构建并发布零人类代码的内部软件产品,代码全由Codex智能体编写。团队分享开发经验,如重新定义工程师角色、让应用对智能体可见等,还面临一些未知挑战。
腾讯「鹅虾」紧急上线!一手实测:养虾门槛归零,QQ飞书钉钉全能接
腾讯昨日上线两个「鹅虾」产品,WorkBuddy是能接入多平台的智能体桌面平台,QClaw预计下周公测,可接入微信。作者实测WorkBuddy,考察其生态接入、代码开发等场景表现,还介绍了QClaw特点及腾讯云轻量应用服务器。
用2D先验自动生成3D标注,自动驾驶、具身智能有福了丨IDEA团队开源
IDEA团队张磊团队提出OVSeg3R开集3D实例分割学习新范式。它无需人工后处理和3D掩码标注,降低训练成本,有望让3D实例分割商业落地,可用于自动驾驶、智能家居等领域。
当心!腾讯、字节等揭示,OpenClaw有无法修复的安全死结
加州大学等机构团队发布对OpenClaw安全的深度分析报告。它是广泛部署的个人伴侣智能体,运行依赖进化理念,但记忆文件成攻击入口。研究在真实网络测评,发现其安全漏洞大,且难以找到进化与安全的完美平衡。
微信今天上线了 ClawBot,这是腾讯打出的一张大牌
微信推出 ClawBot 插件,将 OpenClaw AI agent 接入聊天界面。OpenClaw 原是开源项目,能让普通人用自然语言指挥电脑干活。腾讯同步推产品矩阵,想成 AI agent“入口”和“管道”,但也有体验粗糙等风险。
用大模型检测工业品异常,复旦腾讯优图新算法入选CVPR 2025
AI模型用于工业异常检测获新SOTA,相关论文中稿CVPR 2025。复旦大学、腾讯优图实验室等机构研究人员设计基于扩散模型的少样本异常图像生成新模型DualAnoDiff,实验显示其性能更优。
适配鸿蒙操作系统!!腾讯游戏直播SDK基于Kuikly三端一码开发实践
随着鸿蒙Next发布,腾讯推进游戏电竞直播SDK鸿蒙适配。基于Kuikly框架实现业务代码100%跨三端、跨多App复用,节省超50%人力。介绍适配工作、目标、方案,还提及组件Kuikly化等内容。