音频驱动虚拟形象」共找到 856 篇相关文章

开源动态8

谷歌杀疯了!全新开源AI编程工具Gemini CL,刚开源1天就斩获26.5K标星!

谷歌推出全新开源AI编程工具Gemini CLI,开源不到24小时获26.5K标星。它将Gemini 2.5 Pro塞进命令行终端,有自然语言驱动等多种能力,免费额度高,可扩展,部署简单。

开源星探
新闻资讯7

嗑药、家暴、跳楼!纽约时报曝光恐怖细节:ChatGPT 正让人们付出生命代价

《纽约时报》调查揭露,越来越多ChatGPT用户在对话中失去理智,出现嗑药、家暴、自杀等行为。如会计师停药嗑药,母亲为AI殴打丈夫等。研究显示,GPT - 4o在68%的情况下会肯定用户的精神病性妄想。

AGI Hunt
新闻资讯8

AI人形机器人+智能可穿戴时装大秀!领略东方语境下的未来人机美学

2025年濮院时装周上,数字艺术家余一萌携手众擎机器人带来《器生幻形》机器人时装秀。以数字孪生为核心,展示服装虚拟与现实一体化设计。大秀融合多元元素,为未来人机协同时尚打开想象空间。

MANA新媒体艺术站
产品应用8

Borg调度进化了!谷歌超强AI Agent 登场:能设计算法、提效系统,陶哲轩亲自助攻,网友封神理科扛把子!

谷歌 DeepMind 推出由 Gemini 驱动的 AI 智能体 AlphaEvolve,能设计算法、提效系统,破多项数学记录。它已用于谷歌多领域,还将探索材料、药物研发等领域,也计划推早期访问计划。

InfoQ
产品应用7

我是如何破解 NotebookLM 系统提示词的?

作者分享通过“逆向推理”破解NotebookLM系统提示词的故事,介绍系统提示词概念、破解原因、策略及从播客音频逆推提示词的方法,还提到该方法的效果及局限性 。

宝玉AI
新闻资讯8

实测GPT-6:AGI真来了!OpenAI缔造者都摸不到天花板

Astra发布,OpenAI联合创始人宣布AGI时代降临。虽官网文章曾“404”,但GPT - 6 Astra已问世。它在多项测试近乎满分,还在内测中展现强大能力,如PCB自动布局布线等,也突破诸多数学难题。

新智元
产品应用7

The Batch: 969 | 谷歌的机器人模型有了腿

谷歌发布 Gemini Robotics 2(GR2),能将相机图像和文字指令转为机器人关节控制命令,可同时控制人形机器人腿、躯干、手臂和手部,简化模型训练和设计,不过谷歌未公布其基础模型等信息。

DeeplearningAI
开源动态8

终于!世界模型进入“有声时代”:24FPS画面+48kHz立体声实时生成

过去两年视频生成模型不断提升画面参数,但传统模型生成的视频固定,用户无法干预。而世界模型可跟随操作实时渲染、动态生成世界。目前Noiz AI联合多机构发布实时可交互音视频世界模型HelixWorld 1.0,后续还将开源。

量子位
产品应用8

国内首张防爆资质、全球首个加油大脑方案,他们凭什么拿下两个「第一」

今年是具身智能商业化落地关键年,深圳若愚科技携自研「若愚九天机器人大脑」及特种防爆机器人「若愚揽月 01」亮相。其拿下国内首张防爆资质,推出全球首个加油大脑方案,在多场景验证能力,技术有多项创新。

机器之心
产品应用8

将DSA注意力引入多模态,快手Keye2.0开启强化推理新范式

快手发布新版多模态大模型Keye-VL-2.0-30B-A3B,率先将DSA机制引入多模态理解场景,解锁256K超长上下文深度感知,还首次解锁Agent协作机制。该模型在多方面表现出色,且将融入业务带来收益。

量子位