「全模态AI智能体」共找到 11148 篇相关文章
CVPR 2026 | 还在为AI「鬼画符」发愁?TextPecker即插即用破解文字渲染难题
在生成式AI浪潮中,视觉文本渲染仍是未攻克的核心难题。华中科技大学白翔教授团队等提出TextPecker,是基于结构感知的即插即用型强化学习优化策略,可适配主流生成器,提升视觉文本渲染性能,已被CVPR 2026接收。
美团悄悄上线的AI浏览器Tabbit,我觉得它更适合普通人。
美团光年之外团队发布AI浏览器Tabbit,作者认为它比Comet的Agent能力更强,产品完整细节好还免费。与类OpenClaw产品是互补关系,能处理场景式任务,还有很多实用功能,值得一试。
一个程序员失业了:他用AI重构了整个公司,结果杀疯了!
The Agency是拥有50+专业AI代理的开源项目,能让个人和小团队零人力成本获公司职能,相比传统雇佣,运营成本降99%。它有各部门专业代理,支持多工具集成,应用场景广,使用方法简单。
研究者警告:强化学习暗藏「策略悬崖」危机,AI对齐的根本性挑战浮现
强化学习是大模型推理与对齐的核心方法,但常带来模型行为脆弱等问题。上海人工智能实验室徐兴成博士论文揭示‘策略悬崖’挑战,分析其成因,解释多种对齐失败现象,并提出对AI研究的启示。
5700问答对全面评估拷问AI空间感!最新空间智能评测基准来了丨浙大&成电&港中文
当前视觉语言大模型空间信息学习片段化,缺乏多维度空间推理能力。浙大、成电和港中文团队提出ViewSpatial - Bench基准体系,评估主流模型,揭示其缺陷,并开发MVSM优化跨视角空间理解。
Claude Code终于长出调度台:一个屏幕盯住所有AI会话,无需多开
Anthropic为Claude Code上线Agent视图研究预览版,提供「指挥中心」,可在一个界面管理所有会话。开发者能启动多个AI智能体并行处理任务,一目了然掌握任务状态,还支持在线回复和任务切换。
比「小龙虾」更能打,中国AI视频大模型悄悄登顶全球第一
昆仑万维旗下 SkyReels-V4 Preview 版在权威评测平台超越 OpenAI、Google 等模型,登顶全球第一。它提升语义理解和逻辑能力,新增参考任务,还支持多语言短剧生成、视频编辑等,将在中关村论坛亮相。
以企业AI为支点,中国软件撬动了全球ToB数智市场
全球围绕GenAI开展融资和市场开发,中国软件企业迎来出海新机遇。用友作为特殊代表,既是参与者也是‘吹哨者’。其全球化业务升级,与多企业双赢,且凭借数智能力能与国外巨头竞争。
快问快答|AI都会写代码了,还要不要报考计算机专业?!
在AI大模型能写代码的背景下,InfoQ采访王昊奋、谭晓生、邹欣,探讨高考是否报考计算机专业。他们就专业前景、核心价值转变、核心能力等发表看法,还提及课程调整和其他专业选择。6月30日直播将深入探讨。
马斯克兑现承诺,开源X推荐算法!100% AI驱动,0人工规则
1月11日马斯克宣布7天内开源X平台推荐算法,如今承诺兑现。新算法由Grok驱动,全AI化,移除人工规则。它双引擎驱动信息流、15种行为预测打分,还揭示过滤机制与设计理念,为创作者提供曝光建议。