「多模态大模型智能体」共找到 9766 篇相关文章

新闻资讯7

天使轮数千万元融资,这家公司想成为 AI 时代用户的安全执行顾问

主打认知安全的缔零科技获数千万元天使轮融资,资金用于「缔零法则」技术迭代等。其产品以AI治理AI,降本增效。公司曾推「缔零智数」,现「缔零法则」把控模型推理。未来有ToC计划,想成用户安全助手。

Founder Park
推荐文章7

AutoResearch-LLM:让 Agent 接手 LLM 训练优化

本文是 LLM 微调 AutoResearch 落地实战。作者将电商场景 Qwen3 微调流水线沉淀成 Agent 驱动的三阶段框架,还分享踩坑经验。思路方法与平台无关,可类比到外部环境,适合关注 AI Coding 等的同学。

阿里云开发者
算法论文8

北大大牛团队最新顶会,首次让AI能够生成真实火焰

北京大学陈宝权教授团队提出 FieryGS 框架,被 AI 顶会 ICLR 2026 接收。它将多模态大模型、燃烧物理仿真与 3D 高斯溅射融合,首次在 3D 重建中实现物理可信、语义感知且可控的火焰合成,推动数字孪生发展。

新智元
新闻资讯7

Nature重磅发文:深度学习x符号学习,是AGI唯一路径!

大模型虽惊艳,但权威认为仅靠神经网络难达人类级智能。符号AI曾被边缘化,如今‘神经–符号融合’升温。神经网络与符号算法各有利弊,业界探索出不同融合路径,不过对其能否通往AGI仍存争议。

新智元
算法论文8

LLM本质上永远无法实现真正的正确推理

日本埼玉大学荣誉教授Jingde Cheng论文指出,以ChatGPT为代表的大语言模型(LLM)本质上无法实现真正的正确推理。论文定义了“正确推理”,从逻辑和计算原理论证其局限性,为推理智能体研究指明方向。

深度学习自然语言处理
算法论文8

字节Seed提出M3-Agent:像我们一样"记住"与"思考"的长视频理解新范式

字节Seed提出M3 - Agent,这是首个融合实时视听输入、类人记忆构建与自主推理的多模态智能体。它模仿人类记忆机制,解决长视频理解痛点,已被CVPR 2025收录并开源代码,为通用人工智能奠定基础。

深度学习自然语言处理
产品应用7

AI浏览器必火!

AI浏览器是面向大众的AI Agent,能满足智能搜索与总结、自动化任务、多模态交互等需求。目前赛道竞争激烈,作者认为Perplexity Comet是最佳产品,能处理网页内容、自动化操作,AI浏览器有望成首个杀手级AI应用。

newtype AI
开源动态7

卷疯了!这个清华系Agent框架开源后迅速斩获1.9k stars,还要“消灭”Prompt?

随着大模型能力突破,Agent 从概念走向应用。清华系 Agent 框架 Cooragent 开源获 1.9k stars。其创始人王政认为 Agent 框架要适应多样需求,解决泛化与精确性平衡等痛点,还分享了对 MCP、框架融合等看法。

InfoQ
产品应用8

PCIe显卡被低估了!内核补齐+通信重构,DeepSeek推理吞吐直接翻近7倍

当前大模型算力需求攀升,高端GPU供给紧成本高,大量PCIe长尾GPU算力因框架适配不足被禁锢。是石科技自研Meta-Infer推理引擎,通过纯软件优化挖掘硬件潜力,让DeepSeek推理吞吐提升近7倍,方法也适配国产GPU。

量子位
算法论文8

EMNLP 2025 | T2R-bench: 业内「首个」工业级表格生成报告评测基准

中国电信人工智能研究院推出业内首个面向真实工业场景的“表格到报告”基准T2R-bench,涵盖多领域真实表格、问题与人工标注关键点,配套创新性三维度评测体系。实验显示主流大模型在该任务上表现欠佳,提升空间大。

AINLPer