模长感知」共找到 955 篇相关文章

算法论文8

SearchAgent-X: 打破效率桎梏,释放下一代「AI搜索智能体」的真正潜能

论文提出SearchAgent-X框架解决AI搜索智能体效率难题。研究剖析效率瓶颈,发现精度和延迟问题,提出优先级感知调度与无停顿检索技术,经评估大幅提升性能且不牺牲答案质量。

PaperAgent
产品应用8

字节豆包2.0重磅发布!成本暴降一个数量级,Seed团队揭秘视频Agent竞争关键

今日字节发布豆包大型2.0系列,围绕大规生产环境需求优化,有Pro、Lite、Mini和Code四款型。其Token单价低一个数量级,多态理解能力升级,未来将围绕链路智能系统构建发展。

InfoQ
产品应用8

Token烧不起了?比肩Claude Opus 4.6免费型来了,还将开源

昆仑万维旗下天工AI发布SkyClaw - v1.0,为Agent场景深度优化,免费试用后将开源,价格低。性能超同级别开源对手,逼近闭源巨头。训练围绕环境构建、数据合成、强化学习展开,适合链路Agent工作流。

AIGC开放社区
算法论文8

AI玩拼图游戏暴涨视觉理解力,告别文本中心训练,无需标注的多态大型后训练范式

在多态大型后训练浪潮中,现有方法多以文本为中心。MMLab@南洋理工大学提出Visual Jigsaw,将拼图任务用于后训练,让型不依赖标注强化视觉感知与理解,在图片、视频和3D态验证有效。

量子位
推荐文章8

现有AI都是假实时!Thinking Machines发布交互型,离真正的贾维斯真的近了

Thinking Machines发布交互型,切入与AI交互方式问题。该型能原生支持实时交互,由交互和后台型组成。架构设计独特,解锁多项功能,评测表现佳,但也存在会话、计算部署等局限。

AI寒武纪
新闻资讯7

腾讯胡文博:引领 3D 视频世界型新趋势丨GAIR 2025

2025年12月12 - 13日,第八届GAIR全球人工智能与机器人大会将在深圳举办。腾讯ARC实验室高级研究员胡文博将在13日《世界型》论坛分享《迈向三维感知的视频世界型》。他深耕视频生成型,成果显著。

AI科技评论
开源动态7

面壁智能开源 EdgeClaw,一款安全高效端云协同的龙虾 Agent。

当下AI Agent端侧常被忽视,数据任务都涌向云端致隐私泄露和算力浪费。近期面壁智能等联合开源EdgeClaw,以三级安全和性价比感知协同机制,解决OpenClaw数据泄露、token成本高等问题。

开源星探
产品应用8

阿里Qwen-Image-2.0图像生成与编辑巅峰汇合,超真实、超强图文结合

阿里Qwen - Image - 2.0将生图与编辑能力合二为一。它支持指令,能精准渲染大量文字,引入物理逻辑让文字呈现真实质感,在生图和编辑上对语义理解和画面重构能力强。

AIGC开放社区
新闻资讯7

美国航天局与谷歌合作,打造AI医疗助手,以保证宇航员健康

Techcrunch消息,美国宇航局NASA和谷歌合作开发AI医疗助手CMO - DA,保障前往火星的宇航员健康。它有多种态功能,在谷歌云运行。经测试诊断准确性较高,未来还会增加数据源和情境感知能力。

AIGC开放社区
算法论文8

ICLR 2026 Oral | 让大型学会“像法医般思考”,实现可解释、可泛化的深度伪造检测

生成式AI发展使深度伪造技术安全隐患受关注,现有检测器表现不佳。中科院自动化所联合蚂蚁集团提出Veritas框架,构建HydraFake数据集,赋予大型“感知推理”能力,实验效果超现有检测器,还给出未来研究方向。

深度学习自然语言处理