「多模态 Agent 模型」共找到 9612 篇相关文章

产品应用7

“龙虾”也需要看病?一张旧病历,引出三个新确诊

本文是悟空Agent泛化能力系列先导篇,以OpenClaw项目为例,介绍其通过不同泛化策略发现三个新漏洞,还总结实践原则。强调研究泛化能力对防御漏洞的重要性,4月底悟空Agent将开放试用。

腾讯技术工程
新闻资讯7

The Batch: 890 | 开源终将胜利

IBM研究院AI模型副总裁David Cox认为开源AI应持续繁荣并最终胜利,开源生态是创新发动机。如今部分‘开源模型’未真正开放,真正开源AI潜力巨大,开发好处多,还能解决地缘政治相关问题。

DeeplearningAI
产品应用7

这可能是Claude Code最重要的功能

Claude Code新功能Sub - agents很实用,能创建多个专精任务的Agent,有独立上下文窗口防‘记忆污染’,配置灵活,还能组成工作流。创建简单,比社区项目有优势,是Claude Code截至目前最重要功能。

newtype AI
产品应用7

可塑的计算机Omarchy爆火硅谷,龙虾之父自掏100万投资

Ruby on Rails 作者 DHH 推出 Linux 发行版 Omarchy,将 AI agent 嵌进系统底层,有独特设计和功能。自带安装脚本,安装快。获十位大佬各 100 万美元赞助,多家系统也在探索 AI 嵌入,它有望开启 Agent OS 时代。

AI工程化
新闻资讯8

100万亿Token看懵硅谷!全球一半算力写代码,另一半在「搞颜色」 ?

OpenRouter和a16z联合发布报告,基于100万亿Token实证数据揭秘2025年AI发展。开源模型流量占比达30%,推理模型成主流,编程和角色扮演是主要使用场景,亚洲付费使用量翻倍,中文成全球第二大交互语言。

新智元
开源动态8

Meta视觉基座DINOv3王者归来:自监督首次全面超越弱监督,商用开源

Meta推出并开源视觉基础模型DINOv3,采用自监督学习,首次全面超越弱监督,可生成高质量高分辨率视觉特征。它在多任务表现出色,参数和数据量提升,还构建模型家族,已在多领域产生实际影响。

机器之心
开源动态8

浙大联手字节:开源大规模指令跟随视频编辑数据集OpenVE-3M

浙江大学与字节跳动合作,提出大规模指令跟随视频编辑数据集 OpenVE-3M,有 3M 样本对。还提出数据构造管线、编辑模型 OpenVE-Edit 及评测集 OpenVE-Bench,小参数量下超越现有开源模型。

机器之心
产品应用8

跨境电商版Sora发布:全球首个AI原生电商视频Multi-Agent来了

营赛AI发布跨境电商版Sora——inSai Hilight。它无需拍摄素材与复杂提示词,扔个商品链接或图,20 - 30分钟就能生成逻辑严密、商品还原度100%、符合TikTok爆款节奏的营销视频,重新定义电商营销视频生产方式。

机器之心
算法论文8

只用图像也能思考,强化学习造就推理模型新范式!复杂场景规划能力Max

现有 MLLM 依赖文本处理视觉信息,会造成信息丢失。剑桥、伦敦大学学院、谷歌团队提出视觉规划范式,以强化学习框架 VPRL 提升模型规划能力,实验显示其性能优于文本规划。

机器之心
产品应用8

Claude 4发布!AI编程新基准、连续编码7小时,混合模型、上下文能力大突破

今天凌晨Anthropic开发者大会发布Claude 4,含Claude Opus 4和Claude Sonnet 4。前者是顶尖编码模型,后者是Sonnet 3.7重大升级。还发布系列产品,定价不变,已上线Amazon Bedrock。

Founder Park