实时交互」共找到 864 篇相关文章

新闻资讯8

刚刚,ChatGPT支持MCP了!一句Prompt即可全自动化

今天,OpenAI官宣ChatGPT的MCP功能上线,仅Plus和Pro用户可用。MCP可让AI模型等标准化交互,使ChatGPT自动化程度大幅提高。官方Demo展示其强大潜力,网友态度积极,但功能仍有改进空间。

新智元
产品应用7

再也不怕面瘫脸!YouTube黑科技:AI帮你「永久微笑」,连僵尸都咧嘴笑

YouTube在Shorts相机里实现AI实时「重绘」人脸,效果自然。它通过知识蒸馏将大模型「瘦身」成小模型,用迭代蒸馏打磨细节,PTI保证身份特征,MediaPipe搭建推理管道,还将拓展视频生成功能。

新智元
算法论文8

5秒完成3D场景编辑,北大&港中文&上海AI Lab搞出VGGT-Edit,120倍加速太炸了

北大、港中文等团队提出原生3D编辑框架VGGT-Edit,不再绕回2D,直接在3D空间编辑。它采用残差场预测等机制,在DeltaScene测试集表现出色,单次编辑约5秒,最高120倍加速。

量子位
新闻资讯7

Google 亲手证明:GUI 已死,但尸体还在动

Google DeepMind发布Flash - Lite Browser,能用Gemini 3.1 Flash - Lite实时生成网站。它表明GUI连预先设计都不需要,界面正发生三层分化,虽有不足,但展现界面从预制到即时生成的趋势。

AGI Hunt
算法论文8

强化学习的两个「大坑」,终于被两篇ICLR论文给解决了

现有强化学习算法基于理想化交互模式,难应对真实环境。Mila 实验室两篇 ICLR 2025 论文提出实时强化学习框架,分别解决推理延迟和动作缺失问题,还可结合使用,对关键领域意义重大。

机器之心
算法论文8

NUS、牛津等联合发布音视频智能综述:系统梳理大模型时代的AVI全景图

NUS领衔近10家机构发布音视频智能综述,系统梳理大模型时代AVI发展全貌,涵盖感知、生成与交互,复盘子方向工作,构建任务蓝图,整理评测体系,总结基础技术,还探讨应用、安全及未来研究方向。

新智元
产品应用7

Github 7万星的Clawdbot实测:用国产模型做心脏,躺在床上指挥电脑干活。

本文实测了Github 7万星的Clawdbot(现叫Moltbot),介绍其能在本地运行,可多平台交互,有持久记忆、能控制浏览器等特点,还说明了安装配置过程,指出它虽有不足但想象空间大。

AI进修生
算法论文8

阿里SkillClaw:让 Agent 技能在真实使用中集体进化

当前LLM Agent依赖可复用技能完成任务,但技能部署后静态不变,改进仅停留在当前会话。阿里SkillClaw提出中心化进化架构,将多用户交互作为技能改进信号,通过Agentic Evolver更新技能,经夜间验证后部署。

PaperAgent
新闻资讯8

AI「看见」实验,哈佛颠覆性突破!一副AR眼镜,新手秒变资深专家

哈佛大学刘嘉教授团队研发人机共融智能系统,含APEX和Agentic Lab。前者用于微纳加工,后者用于生命实验。实测显示,它们能实时纠错、自动记录分析、实现技能迁移,让AI与人类在科研制造中深度融合。

新智元
新闻资讯8

AI当员工,24小时不休息,17天干完人类数年活!

劳伦斯伯克利国家实验室正将人工智能、自动化技术和数据系统融入科研,构建“人机共生”科研生态。像A - Lab、Autobot等工具发挥重要作用,AI还让大科学装置更智能,实现实时决策,开创“AI设计,实验验证”模式。

AIGC开放社区