「目标实现」共找到 2615 篇相关文章
AI智能体加持,爆款视频产出速度提升了10倍,全民导演时代已来
Video Ocean在影像创作领域带来革新,通过AI Agent实现一人完成多职能,将拍摄周期大幅缩短。它打造自动化创作生态,能快速批量生成爆款视频,覆盖多种创作场景,操作简单,打破创作壁垒。
给Claude Code加个音效提醒
文章指出Claude Code缺少提醒功能,作者用Claude Code自带的hooks功能和macOS系统的afplay工具,实现音效提醒。需要确认时播放塞尔达传说BGM,完成时播放超级马里奥BGM,还介绍配置方法。
清华校友出手,8B硬刚GPT-4o!单一模型无限工具调用,终结多智能体
MIT等机构推出TIM和TIMRUN组合拳,突破模型token天花板。TIM将推理建模为任务树,TIMRUN优化内存管理。二者结合支持长程推理,实现单模型高效推理,简化智能体构建,在多方面表现出色。
刚刚,谷歌摊牌:Genie 3让你1秒「进入」名画,人人可造交互世界!
谷歌新发布Genie 3世界模型,能从文本生成交互式AI空间世界,操控图像和视频。用户可进入《苏格拉底之死》《夜游者》等名画探索,还能利用它训练3D模型,实现沉浸式体验。
安全噩梦:Docker 警告 MCP 工具链中存在的风险
Docker 博文警告,基于 MCP 构建的 AI 开发工具引入安全漏洞,如凭证泄露等。MCP 发展迅猛但部分实现有隐患,Docker 分析发现广泛漏洞,还提出强化方法应对风险,其他厂商也有类似担忧。
长得这么“乖”的人形机器人,第一次见
北京朝阳,傅利叶发布全尺寸人形机器人Care-bot GR-3,外观采用莫兰迪暖调配色等设计,有亲和力。它配备全感交互系统,能实现多种拟人行走姿态,未来将拓展至辅助陪护场景。
ScreenCoder:视觉-代码对齐新范式,为多模态程序合成开辟道路
前端开发中UI转代码耗时易错,现有工具存在不足。ScreenCoder提出模块化多智能体框架,通过三阶段分工协作实现代码生成,还构建数据引擎推动VLMs进化,实验表现出色,为多模态程序合成开辟道路。
无需准确传感信号!轻松搞定「多段软体机械臂」复杂位姿与形状控制
研究人员提出利用双向循环神经网络(biLSTM)的MSCA规划与控制策略,即便用不准确内部传感信号也能完成任务。实验显示该方法在多任务中表现优异,未来还将做进一步研究。
从WAIC上爆火的功夫机器人,看到这家央企的具身智能「真功夫」
今年4月“功夫boy”机器人出圈,3个月后的WAIC上它全新升级。其背后是中国电信人工智能研究院(TeleAI),由李学龙教授带领。他们技术栈全面,在硬件、软件、数据等方面全栈自研,还布局智传网,未来发展潜力大。
腾讯无极低代码平台打开MCP之外的新思路:多模态聊天
腾讯无极低代码平台提出‘前端多模态智能’概念,让AI输出内容更多样,可嵌入交互页面片。它还给出四步配置法实现‘多模态聊天’,与MCP形成互补,能增强信息交互和用户掌控感。