「视觉领域」共找到 2307 篇相关文章
ToC智能体火得快,但更大的价值在企业丨中关村科金@MEET2026
在大模型与智能体快速普及当下,中关村科金总裁喻友平判断AI时代核心是连接更强。他提出企业智能化是长期工程,真正让智能体规模化落地需重构底座平台能力,还介绍了应用场景等。
GPT-5.2 发布:做表格、写 PPT、敲代码 | 打工人的生产力利器
GPT - 5.2发布,在GDPval评测等众多基准测试中刷新行业水平。GPT - 5.2 Thinking适合真实场景与专业工作,在知识型任务、编码、长上下文处理、视觉理解、工具调用等方面表现出色,部分功能需付费使用。
全图与切片并非等价?LLaVA-UHD-v3揭示差异推出高效全图建模方案
随着多模态大模型发展,处理高分辨率图像成关键。主流视觉编码范式难兼顾性能与效率,清华和中科院团队发布 LLaVA-UHD v3,提出 PVC 框架,对比 SBE 和 GNE,验证其在提升效率同时保留模型能力。
DeepSeek V3到V3.2的进化之路,一文看全
知名AI研究者Sebastian Raschka发布深度博客,详细梳理DeepSeek V3到V3.2进化历程。DeepSeek V3.2性能对标GPT - 5和Gemini 3.0 Pro,且为开放权重模型,报告涵盖众多有趣领域和知识。
2025元宇宙大赛获奖作品公布|“交互幻境”创意赛
2025年第三届元宇宙设计创意大赛“交互幻境”创意赛获奖作品公布。赛事3月启动,获上海工会支持,征集全球3148份作品。赛事探索元宇宙与现实融合,推动多领域数字化转型,下面介绍了各奖项获奖作品。
罗福莉首个小米成果!开源具身大模型
正式入职小米不到10天,罗福莉作为核心作者的首篇论文出炉。MiMo团队提出并开源全球首个打通自驾与具身操作领域的跨具身基座模型MiMo - Embodied,在29个Benchmark上霸榜。
杨植麟带 Kimi 团队深夜回应:关于 K2 Thinking 爆火后的一切
上周,月之暗面发布并开源 Kimi K2 Thinking,主打“模型即 Agent”,一上线便引发关注。今日凌晨,杨植麟等人在 Reddit 开展 AMA 活动,回应 K2 Thinking 一系列问题,还回顾了其在多项测试中的亮眼成绩。
Leogra AI:BVP 投资的欧洲版 Harvey,给每位律师配一位协作 Copilot
本文介绍瑞典法律AI公司Legora,其获1.5亿美元C轮融资,估值18亿。它让律师与AI并行工作,产品覆盖审查等环节。文中还阐述法律科技变革,以及其商业模式、竞争风险、团队文化和全球化策略等。
从“卡脖子”到“破局点”:一家中国公司的高端半导体键合突围战
芯师爷专访迈姆思半导体负责人潘总,该公司专注高端半导体材料“再制造”,技术体系有高端SOI制造、异质集成、混合键合三大支柱。其在多领域有领先产品,技术壁垒高,产能将逐步扩大,供应链安全可控。
可口可乐又翻车了?用AI做圣诞卡车广告,观众说「没灵魂」!
2025年可口可乐用AI生成圣诞卡车广告,虽品牌方称工艺提升十倍,但观众觉得没灵魂。此前春晚吉祥物‘龙辰辰’也因疑似AI制作遭质疑。AI复制情感能力已蔓延各领域,引发对情感表达的思考。