「多模态Agent模型」共找到 9639 篇相关文章
Snowflake CEO 复盘:为什么 LLM 时代企业需要一个 AI Data Cloud?
Snowflake曾是企业数据平台代表,随AI崛起,CEO Sridhar推动其转型为AI Data Cloud。Snowflake Intelligence上线,不造基础模型,专注放大数据价值,其可靠、计费合理,核心竞争力在数据。
Sand.ai重磅更新MagiAttention,正在定义分布式Attention性能新标杆
2025年4月,Sand.ai开源MagiAttention v1.0.0。如今发布v1.1.0,适配Blackwell新架构,构建原生Group Collective原语,经系统级协同优化,在多模型训练中得到实证,展现卓越性能。
百度搜索 10 年来最大改版,支持超千字长文本输入和 MCP 调用
7月2日,百度搜索宣布十年来最大改版,搜索框变“智能框”,支持超千字输入,集成AI写作等功能。“百看”功能、AI助手升级,接入视频生成模型MuseSteamer,还接入1.8万+MCP,提升搜索体验。
Jev 的「百亿补贴」迷局:既然「极省」为何还要狂送 1.2 亿 Token?
主打省Token的AI模型Jev,近日大手笔向用户发放1.2亿Token额度,本文深入分析这一反常操作背后的商业布局,拆解其抢占Agent小决策判断节点的底层逻辑。
装了 AI 大脑的 Grep
本文介绍了 mgrep 工具,它有自然语言搜索、支持多语言多模态等特点。还说明了使用方法,如安装、登录、索引项目和搜索等,能与编码 Agent 配合,可补充 grep 进行代码搜索。
MCP 已死?不,它正在进化:三个关键变化
本文针对网传“MCP已死”的说法,解读最新版MCP模型上下文协议的三大核心变化,对比MCP Tasks与A2A的区别,给出选型建议,帮助开发者适配企业级Agent场景需求。
含全文!OpenAI发布GPT-5官方Prompt指南
OpenAI 发布《GPT-5 prompting guide》,介绍新模型变化及使用方法。新增 `reasoning_effort` 和 `verbosity` 参数,还有 Responses API。Cursor 分享实战心得,同时提及控制 Agent 积极性、解决指令冲突等内容。
Thinking with Video:一种全新的思考范式
在人工智能领域,‘用文本思考’和‘用图像思考’存在局限。复旦大学等团队提出‘用视频思考’范式,通过视频生成模型统一文本与视觉推理,构建VideoThinkBench基准测试Sora - 2,全面解读这一开创性工作。
「边思考、边搜索、边写作」WebThinker开启AI搜索&研究新纪元!
大型推理模型有推理能力,但静态知识限制其在复杂任务表现。WebThinker 让 LRM 推理中自主搜索、导航及写报告,集成探索器,有自主策略和训练工具,实验显示性能强,还指明未来探索方向。
AAAI 2026 Oral | 悉尼科技大学联合港理工打破「一刀切」,联邦推荐如何实现「千人千面」的图文融合?
悉尼科技大学龙国栋团队联合港理工杨强、张成奇团队提出 FedVLR 框架,解决联邦环境多模态融合异质性难题,被 AAAI 2026 接收。该框架创新性强,可提升推荐指标,代码已开源。