「生成式智能体」共找到 5538 篇相关文章
蚂蚁投了一家具身智能公司,做手的
具身智能市场火热,灵心巧手完成数亿元天使轮融资,由蚂蚁集团领投。该公司成立于2019年,此前已有超亿元种子轮融资。其自研灵巧手技术强、成本低、销量高,应用广泛,未来将聚焦软硬件协同。
多模态需求井喷,智能视频云如何靠分布式处理破局?
国内多模态AI发展中,模型层火热但应用层落地慢。多模态应用落地面临体验升级、视频化扩展、大模型部署下沉挑战,催生智能视频云升级需求。火山引擎在FORCE大会展示分布式多媒体处理实践,推出MIPP平台,未来将开源并推商业化产品。
用系统架构思维,告别“意大利面条式”系统提示词
本文作者分享编写系统级提示词经历,指出‘规则清单式’设计有规则打架、维护难、价值稀释问题。引入系统架构思维,构建四层设计框架,给出编译原则与模板,还重构‘AI编程助手’提示词,实现从‘规则管理者’到‘系统设计师’转变。
刚刚,Meta 超级智能团队44名成员信息曝光,半数来自中国
风投公司投资人晒出匿名Meta员工盘点的超级智能团队44名成员信息,半数来自中国,成员学历、履历等情况明晰,但有人质疑名单真实性和全面性,团队阵容或更庞大。
腾讯重磅开源!端到端视频音效生成模型HunyuanVideo-Foley
腾讯混元正式开源端到端视频音效生成模型 HunyuanVideo-Foley,适用于多场景。它采用新型框架结合 REPA 策略,有三大核心优势,能适配多种场景,抑制底噪,保证音频保真度。
GAIR Live 预告|从 IROS 2025,看智能机器人前沿趋势
IROS 2025 近日在杭州闭幕,作为全球机器人领域盛会,展示具身智能新突破与方向。GAIR Live 将携手学者与产业领军者,通过线上直播解读其核心趋势,拆解研究范式转向,还设有多个热门话题探讨。
智谱联合清华开源多图参考视频生成模型,带来主体一致性新高度
合肥工业大学、清华大学和智谱开源多主体参考视频生成模型Kaleido。它用全新数据构建法和精巧架构,解决主角与背景混淆难题,实验显示其在多维度表现优异,超越现有开源模型。
AI 会生成 PPT 之后,Runtime 决定了它能做多好
作者回顾PPT Agent发展,指出存在Agent理解操作文档及AI生成PPT表达单一的问题。提出Artifact Runtime概念,它让PPT可被持续操作,还能接管重复决策,但不能替代专业判断。
综述:LLM 驱动AI Agent通信协议与策略
文章指出传统互联网用户完成行程繁琐,而代理互联网可让代理自动完成。随着LLM驱动智能体应用深入,其发展专业化,需多智能体协同,有效通信成关键。介绍了智能体通信定义、分类及多种通信协议。
狂肝一周,测评十余款 PPT AI 生成产品的真实反馈
评估 Agent 产品能力复杂,以 PPT 生成为例,有 Agent 和模板化两种流派。作者选前者投票测评、后者全方位测试。给出方案,还推荐不同需求适用产品,附总榜单和细致体验描述。