对象级理解」共找到 1688 篇相关文章

新闻资讯7

硅谷祛眼袋,海淀求嫩肤:中外科技老哥都在偷偷卷颜值

加州整形外科医生爆料,过去五年科技圈男性做医美的多了五倍,对拉皮等开刀项目也趋之若鹜。国内科技大厂周边医美机构男性客户也增多,多以轻医美为主。科技从业者医美需求飙升,与年龄焦虑和找对象需求有关。

量子位
推荐文章7

告别模板时代!妙多VP张昊然:生成式AI如何驱动UI设计的范式革命

在AICon2025上海站,妙多副总裁张昊然分享生成式AI在UI设计领域的影响。他回顾初代生成式UI的‘套模板’技术,讲述技术革新后回归代码生成界面,还探讨让AI理解设计系统、妙多AI 2.0理念及未来UI工具假设。

InfoQ
算法论文8

南大团队直击大模型高分神话:人类90分,最强模型仅49分

南京大学傅朝友团队在Google Gemini评测团队邀约下推出视频理解新基准Video - MME - v2。它有创新的分层能力体系与组非线性评分,经超3300人工时标注。评测显示模型与人类差距大,还揭示传统Acc指标虚高、‘Thinking’并非总增益等现象。

新智元
开源动态8

Issue修复开源No.1!蚂蚁 | 提出代码图模型:CGM,结合GraphRAG架构,领先最强开源7.33%

为解决开源模型在仓库代码理解上的能力瓶颈,蚂蚁全模态代码算法团队提出 CGM 架构,融合仓库结构与语义信息。CGM 首创图结构与语言模型融合的对齐框架,还搭配了 GraphRAG 框架,在多个代码任务中表现出色,且相关资源均已开源。

AINLPer
新闻资讯7

OpenAI获五角大楼2亿美元订单,迈向军工领域

OpenAI推出“OpenAI for Government”计划,为美国政府提供AI工具。首个合作是与五角大楼的试点项目,合同上限2亿美元,用于变革行政运营,州和联邦层面已有应用实例。

AIGC开放社区
开源动态8

字节开源高效解析文档图像的新型多模态模型Dolphin,快速将复杂的文档图像转化为结构化数据。

字节开源新型多模态模型Dolphin,采用“先分析后解析”范式,能将复杂文档图像转化为结构化数据。它有卓越性能和多种特性,还提供安装、推理使用指南。

GitHubStore
开源动态8

MiniMax海螺视频团队首次开源:Tokenizer也具备明确的Scaling Law

MiniMax海螺视频团队首次开源,揭晓视觉分词器难题答案。其推出的VTP框架可提升模型性能,解决传统Tokenizer缺陷,还展示了Tokenizer的Scaling Law,为行业提供新路径。

量子位
新闻资讯7

图像模型今夜变天?谷歌刚刚泄露了「Nano Banana Pro」这张王牌

谷歌DeepMind CEO置顶「预告」,传言中的Nano Banana Pro登场在即。它基于Gemini 3.0 Pro引擎,速度、画质大幅升,懂界面排版,创作力强,有望让图像模型迈进「专业时代」。

新智元
新闻资讯7

专访酷哇杨学:世界模型的下半场,是把一次成功变成长期服务|甲子光年

在2026世界人工智能大会上,具身智能行业关注点从机器人能动转向能否进入真实场景干活。酷哇科技宣布杨学出任首席科学家,共建通用具身智能联合实验室。杨学认为行业应从证明技术转向证明实用,解决机器人在真实场景的长期稳定运营问题。

甲子光年
新闻资讯7

作为软件架构师使用 AI 的经验

Avraham Poupko 在 OOP 大会分享软件架构师用 AI 经验,认为软件架构师不会被 AI 取代,AI 适合探索权衡、提炼语言,但缺乏情境推理和情感智能,人类在这方面更有优势。

InfoQ