「Agent 框架」共找到 3998 篇相关文章
开源多模态大模型EarthMind,观测地球统一框架
地球观测数据复杂,现有多模态模型难适用。意大利、德国多所高校研究人员联合开源多模态大模型EarthMind,引入空间注意力提示模块,实现跨模态融合和多粒度理解,解决地球观测难题。
吴恩达开新课教OCR!用Agent搞定文档提取
随着AI大模型发展,OCR重新成为技术专项,DeepSeek、智谱、阿里千问和腾讯混元等都在研究。吴恩达开新课,提出智能体文档提取(ADE)方案,准确率达99.15%,还给出本地和云端部署线路。
Google发布2026 AI Agents五大变革趋势
Google Cloud《2026 AI智能体趋势报告》,基于全球3466家企业调研揭示五大核心趋势,包括人人拥有智能体释放创造力、驱动工作流、重新定义客户体验、安全主动防御及人才升级等,凸显以人为本的AI变革。
在 Cache-DiT 框架下实现原生 Serving功能
Cache-DiT 是唯品会开源的 PyTorch 原生 DiT 推理加速引擎,此前聚焦离线推理。现实现完整 Serving 功能,支持单卡与分布式推理模式。文章介绍其实现过程、借鉴 SGLang 的设计,还总结踩坑及使用方法。
OpenAI 万字报告: 不要再卷Agent了~
OpenAI《How People Use ChatGPT》报告显示,73%的ChatGPT用途与工作无关,用户多将其用于实用建议、信息查询和写作。Asking对话占比及满意度更高,机会藏在人类惰性里。
The Batch: 852 | 加州重新制定人工智能监管框架
加州人工智能前沿模型联合政策工作组发布《加州前沿人工智能政策报告》,为立法者提供监管尖端AI模型的政策原则。报告聚焦前沿模型监管,提出综合多源证据、鼓励信息披露等结论,还探讨了美国AI监管现状。
清华-腾讯联手:音频 - 视觉多模态任务统一框架
Crab是人大、清华和腾讯合作论文提出的模型,目标是高效一统多模态场景理解任务。它解决了音频 - 视觉理解模型任务干扰、合作显式化不足等难点,通过构建数据集、设计结构和统一架构实现多任务合作。
「AI黑客」来袭,Agentic AI如何成为新守护者?
AI 发展带来网络安全新威胁,如生成式 AI 诈骗、深度伪造等。业内共识是以 AI 对抗 AI,有模型防护、行业应用、政府协作三类尝试。青藤云安全推出全栈式安全智能体「无相」,革新安全思维。
争夺 Agent 市场,微软的押宝点竟是「情商」?
微软AI CEO Mustafa Suleyman接受访谈,分享AI未来见解,探讨情商重要性等问题。他推动AI从功能向人性化发展,认为AI是伴侣非仅工具,强调情感连接,还提及Copilot靠情商打差异化等。
Meta首个Agent生图模型登场,空降竞技场第二
Meta超智能实验室推出图像生成模型Muse Image,引入智能体机制,能编写代码、网络搜索,有自主修正能力,支持算力扩展、多轮编辑与画面合成。还预览了Muse Video,两模型均与Meta产品深度整合。