三域融合大模型」共找到 8522 篇相关文章

开源动态8

彻底告别VE与VAE!商汤硬核重构多模态:砍掉所有中间编码器

商汤科技联合南洋理工大学发布NEO - unify,这是“原生、统一、端到端”多模态模型架构,砍掉VE和VAE,用混合变换器架构打通视觉与语言能力,提升数据与算力利用效率,为跨模态智能系统奠基。

量子位
开源动态8

AI版权侵权难以“定罪”?Copyright Detective:首个集成多范式检测的交互式版权取证系统

随着生成式AI广泛应用,版权纠纷成AI领域棘手挑战。张登辉等研究人员推出Copyright Detective系统,集成多范式检测,解决单一检测局限,为大模型文字版权风险提供全方位“体检”方案。

深度学习自然语言处理
产品应用7

上手“设计界的Manus”,朱啸虎点赞,Lovart这波魔法破圈了丨TIP 002

国产出海产品Lovart被称为“设计界的Manus”,获朱啸虎点赞。它是设计领域首个Agent,能用自然语言驱动生成多模态视觉作品,可生成VI体系、短片等,适合文创领域,还能人工编辑,调用多模型

鲸选AI
新闻资讯8

刷屏了!前OpenAI研究员做的Jev,大家为啥抢着用?

TypeSafe AI发布专门处理结构化判断的AI模型Jev,发布后迅速在AI开发者社区刷屏,凭借低延迟、低成本优势,被广泛用于AI Agent任务验收等场景,引发业内关注。

机器之心
产品应用7

Claude Code 更长更快!Agent能自己管项目了!从 Todo 升级到 Task

上周Claude Code团队更新任务清单系统,从「记事本」升级为「项目管理系统」。因模型能力增强,需求变复杂,原TodoWrite无法满足,新Task系统解决了任务依赖协调问题,支持复杂项目。

AI产品自由
开源动态8

开源屏幕感知AI助手,快捷键即调,随时看懂屏幕上的一切!

日常Windows桌面工作调用AI助手常打断专注流。GitHub新开源工具Everywhere,能自动感知屏幕内容,快捷键即调,支持多模型,有网络搜索和Markdown渲染功能,多种场景适用。

开源星探
产品应用8

ChatGPT长了手脚,AI不再是副驾,直接抢过方向盘

OpenAI昨夜发布ChatGPT智能体,它整合网站交互、信息整合、对话交互项能力,能智能选最优路径完成任务。在多项评估中表现领先,还有多重安全措施。今日向部分用户开放。

AI工程化
新闻资讯8

2025年第二届「兴智杯」全国人工智能创新应用大赛正式启动,线上报名开启

2025年5月8日,第二届「兴智杯」全国人工智能创新应用大赛启动,由多机构主办。大赛聚焦关键能力设赛题,分主题赛和总决赛,有激励机制。深圳产业优势突出,共同主办助力人工智能融合发展。

机器之心
新闻资讯8

Anthropic发布Fable 5.1:科研、编程能力翻倍,成本最高降45%

当地时间9月1日,Anthropic推出Claude Fable 5.1和Claude Mythos 5.1。Fable 5.1科研、编程能力翻倍,成本最高降45%,还能解决实际问题,此次模型竞争转向多方面综合较量。

DeepTech深科技
开源动态8

真牛,4千行代码,媲美OpenClaw,开源 nanobot 到底强在哪?

本文拆解GitHub热门开源项目HKUDS/nanobot,它是超轻量个人AI助理,核心功能约4000行代码,易读易扩展。支持多模型、多渠道,有定时任务和Docker用法,适用于多场景。

小华同学ai