「AI能力猜想」共找到 11260 篇相关文章
360开源高质量图文对齐数据集!收纳1200万张图像+1000万组细粒度负样本,让模型告别“图文不符”
360人工智能研究团队的冷大炜博士团队开源FineHARD高质量图文对齐数据集,包含1200万张图像、4000万个边界框及对应描述、1000万组细粒度难负样本,能提升模型图文对齐能力,还介绍了构建方法、分析及应用前景。
帕西尼再融10亿元,具身感知赛道跑出35亿元融资纪录
帕西尼获10亿元战略轮融资,累计35亿领跑全球具身感知赛道。本轮由巨头和基金联合领投,形成“四位一体”资本生态。其全栈自研,具先发优势,正推动具身智能发展,目标成产业能力底座。
全网爆火的龙虾总失忆?大佬亲自下场手搓解药,终结致命痛点
OpenClaw项目爆火,但龙虾存在「失忆」问题。TiDB联合创始人黄东旭发布免注册的永续记忆服务mem9.ai,解决其记忆痛点。它一虾一库、免注册、支持备份迁移等,还上线个人记忆空间,与OpenClaw官方架构深度配合。
清华给电子显微镜加上Agent,DeepSeek V3全程调度,数天流程缩短至几分钟
清华大学牵头,联合多机构推出电镜领域AI Agent AutoMat,它能把原子级STEM图像转成标准CIF结构并给出关键物性,将人工流程缩短至几分钟。它还构建数据集验证,性能超现有工具,不过也有瓶颈待解决。
波士顿动力机器人进厂打工现逆天操作!3D感知+实时追踪,人类捣乱完全不带怕的
波士顿动力的Altas机器人重磅升级,具备3D空间感知和实时物体追踪能力,可自主执行复杂工业任务。文章还解析其背后技术,包括2D感知、3D感知、物体位姿估计和校准等,团队未来将构建统一基础模型。
6天烧光2000多万,拿下开源第一!小米史无前例「炼丹直播」收官
本文报道小米开启史无前例的大模型训练直播,6天花费约2344万元完成MiMo-V2.6系列强化学习训练,训练出的MiMo-V2.6-Pro登顶开源大模型第一,全套技术资源全部开源,引发AI行业热议。
Deepseek V4 Pro发布,除了多模态,满足我对模型的所有想象
DeepSeek官方文档更新模型日期,意味着DeepSeek V4 Pro正式版来临,已在官方API提供。它采用MoE设计,接口能力强,Agent能力得到大幅强化,评测成绩亮眼,价格实惠且有API兼容性,不过有并发限制,近期还将上调价格。
Fable5仅做对3.5%!大模型会看图,但还没有主动视觉
本文介绍了专门测量「主动观察」能力的视觉推理基准 ActiveVision,评测显示无外部工具时,大模型与人类准确率有近 9 倍差距,用工具后虽提升但仍远不如人类,还说明了其出题与避免取巧的方式。
AMS| 西工大史子颉,高传强,王旭,林海涛,张伟伟:数据驱动的涡激振动标度律发现
涡激振动最大振幅是评估结构安全的关键指标,现有理论模型有局限,常用数据驱动方法也面临挑战。本文提出两次应用符号回归的“白箱”标度参数VIV建模方法,验证了其鲁棒性与泛化能力,还给出物理层面解释。
半年不写代码,Claude Code之父:3年后写代码的人暴涨100倍
Claude Code之父Boris Cherny称,虽软件工程师职称或消失,但3年后写代码、用智能体的人会是现在100倍。他列出Claude Code团队的5种角色,指出岗位边界在融化,AI时代清理者角色更关键。