「多模态大模型智能体」共找到 9766 篇相关文章
人人都能炼专属Agent,上海交大开源端侧Agent全栈工具链,真实场景性能超GPT-5!
上海交大开源端侧Agent全栈工具链MobiAgent,将构建手机Agent全流程开放。它在真实场景性能超GPT - 5,还设计“潜记忆加速器”,通过三步养成Agent,评测表现出色,降低移动智能体开发门槛。
避免Claude Code 降智的一小招
Claude Code近期表现变差,简单代码逻辑会搞混,调试建议也不对。作者分享小妙招,切回Opus 4.0能让其恢复智商,还介绍三种切换模型方式,并分析了其降智原因。
基于 Elasticsearch 创建企业 AI 搜索应用实践
Elastic 中国社区首席布道师刘晓国,分享基于 Elasticsearch 创建企业 AI 搜索应用实践,介绍其向量搜索技术及 RAG 应用开发,还提及智能时代搜索需求变化、混合搜索优势及 Elasticsearch 优化改进等内容。
太强了 Yan!腾讯打造的全能交互视频生成引擎
腾讯提出的面向交互式视频生成的基础性框架 Yan,集 AAA 级模拟、多模态生成和多粒度编辑于一体,为下一代 AI 内容引擎提供可行路径,但也面临长时视频视觉一致性不足等问题。
AI 编程冲击来袭,程序员怎么办?IDEA研究院张磊:底层系统能力才是护城河
在 AICon 大会上,IDEA 研究院张磊剖析多模态智能体发展难题,提出从“半结构化”场景切入的落地路径,分享工业界研究与产品平衡见解,还为年轻人在 AI 浪潮中发展给出建议。
vLLM 技巧: 在几秒钟内无需重启释放90%的 GPU 显存
EmbeddedLLM介绍vLLM新功能“休眠模式”,可在不重启服务时几秒内释放约90% GPU显存,实现模型热插拔与高效轮转,还介绍使用方法、不同休眠级别,提醒生产环境要确保安全。
故事式
作者李继刚在好友丁锐启发下尝试「故事式」Prompt,即塑造含「欲望」与「阻力」的动力场让模型生成回复,还给出如「字典疯子」「探索者」等多个故事式Prompt示例供读者体验。
字节开源DreamO,一个框架包揽多种图像定制需求
近期图像定制研究展示大规模生成模型潜力,但多数方法通用性有限。字节提出DreamO框架,支持多种图像定制任务,有特征路由约束机制,能解决特征冲突,还介绍其技术原理与各任务效果。
1400亿Agent入场,“流量”这条护城河要塌了
在支付宝AI生态大会上,蚂蚁集团CEO韩歆毅提出Agent时代流量逻辑失效、信任逻辑崛起。他还指出人的流量让位于智能体生态,Agent重构商业决策权,AI支付将成全球新基建。
Claude 吞噬整个AI编程栈?“Vibe Coding 公司的最大错觉是以为自己有护城河”
近日网友爆料Anthropic开发类似Lovable功能,可构建全栈应用。此前Claude Code源码泄露,展示其构建软件开发全流程“执行层”能力。AI编程进入“大收割时代”,模型厂商吞噬工具趋势显现,Lovable等平台护城河受挑战。