「空间能力评估」共找到 4125 篇相关文章

开源动态8

攻克结构化长文档检索难题!新框架让模型告别“结构性失明”

SEAL团队推出全新对比学习框架SEAL,通过带结构感知和元素对齐,将文档宏观层级结构和微观元素语义融入Embedding空间,提升模型对结构化数据的理解。在BGE - M3模型上提升了MRR@10指标,还开源了万级字数长文档数据集。

量子位
开源动态7

DeepSeek-R1今天一次「小更新」,颠覆了大模型格局,网友:尽快放R2

昨晚,DeepSeek官方宣布其R1推理模型升级到最新版本(0528),并公开模型及权重。该版本参数量高达6850亿,采用MIT许可证,性能提升明显,在多个基准测试中成绩优异,网友实测代码能力也大幅提升,但仍存在过度思考问题。

机器之心
产品应用8

谷歌Nano Banana Pro炸了!硅谷AI半壁江山同框,网友:PS已死

谷歌推出基于Gemini 3 Pro的图像生成模型Nano Banana Pro,在图像编辑和生成上实现史诗级进化,有更广知识储备、超强文字渲染和精准细节把控。它支持4K原生,知识推理强还能直连搜索,玩法多样但也有改进空间。

新智元
产品应用8

业界首个高质量原生3D组件生成模型来了!来自腾讯混元团队

腾讯混元3D团队推出业界首个高质量原生3D组件生成模型Hunyuan3D - Part。现有3D生成算法有局限,该模型提出新范式,含P3 - SAM和X - Part,在多数据集评估中超越现有工作,还给出体验地址和论文地址。

量子位
产品应用8

GenAI 退烧后,这家企业正在用 “数据平台” 重构AI2B的底层逻辑

GenAI浪潮下,企业级AI落地难。矩阵起源举办新品发布会,其CEO王龙指出落地瓶颈已从大模型转向私域数据。该司推出MatrixOne和MatrixOne Intelligence,构建“数据智能飞轮”,MOI三层架构可打通数据到业务落地流程,还通过案例展现其解决实际痛点能力。

InfoQ
算法论文8

南大团队直击大模型高分神话:人类90分,最强模型仅49分

南京大学傅朝友团队在Google Gemini评测团队邀约下推出视频理解新基准Video - MME - v2。它有创新的分层能力体系与组级非线性评分,经超3300人工时标注。评测显示模型与人类差距大,还揭示传统Acc指标虚高、‘Thinking’并非总增益等现象。

新智元
产品应用7

脑子比不过AI,手也要沦陷了?这只灵巧手看得我有点慌

人类手部结构和功能复杂,将其能力复刻到机器人身上是梦想,由此衍生出“灵巧手”方向。但多数“灵巧手”存在不足,世界机器人大会上一款“灵巧手”表现出色。灵巧智能选择柔性传动,其产品DexHand021 Pro优势明显,未来将提升感知和智能水平。

机器之心
新闻资讯8

谷歌全线开挂!Gemini 3 Deep Think夺多项推理SOTA,Gemini亚洲新团队也官宣了

谷歌的Gemini 3 Deep Think模式正式上线,推理能力显著加强,在ARC - AGI、HLE等多项权威测评中夺魁,仅向Google AI Ultra订阅用户开放。同时,谷歌DeepMind将在新加坡成立新的Gemini研究团队,由95后华人科学家Yi Tay带队。此外,谷歌还推出了Google Workspace Studio。

AI前线
新闻资讯8

具身智能落地物流行业的最大难题,被京东物流撕开一道裂缝

在科技领域,物流行业常被视为最不“性感”的赛道之一。随着具身智能火爆,智慧物流又迎来新的想象空间。9月25日,在JDD 2025京东全球科技探索者大会上,京东物流正式发布“超脑2.0”与“异狼”系列新品,旨在填补物流智能化“认知”与“执行”高度统一的关键空白。

AI前线
新闻资讯8

Skill vs App:一场入口范式的争夺

量子位举办的「龙虾时代,Skill会吃掉App吗?」主题沙龙上,多位从业者围绕Agent生态、Skill能力边界、App未来形态等话题展开讨论。指出Skills不会完全干掉App,App会以Skill形式继续存在并进化,还探讨了App在AI时代的多种走向及面临的问题。

量子位