性能验证」共找到 2633 篇相关文章

开源动态8

混元开源PhoneBuddy-4B与5篇系列论文:多项手机Agent真机评测超过GPT-5.4

腾讯混元Phone - use Agent团队发布PhoneBuddy - 4B及5篇系列论文。研究探讨如何训练真实可用的Phone - use Agent,采用Real + Mock方式,实验显示该方法提升效果显著,4B模型多项任务超GPT - 5.4。

量子位
算法论文8

让机器人学会「预判接触」:它石智航牵头四大顶尖机构发布TacForeSight,破解精细操作难题

它石智航联合四大顶尖机构发布论文 “TacForeSight: Force-Guided Tactile World Model for Contact-Rich Manipulation”,提出力条件触觉世界模型,让机器人能提前预判接触变化,在真机验证性能优异。

机器之心
新闻资讯8

中国首次提出半导体演进新原则:华为“韬定律”5 年内冲刺等效1.4nm制程,麒麟、昇腾将先后落地量产

5月25日,华为何庭波在研讨会上提出“韬定律”,以“时间缩微”替代“几何缩微”。论文展示验证案例,预计2031年高端芯片达1.4nm等效水平,今年秋季麒麟新芯片将首发“逻辑折叠”技术。

AI前线
开源动态8

参数砍到 1B,这个小钢炮拿下多模态第一

面壁智能发布并开源参数量仅 1.3B 的 MiniCPM-V 4.6,虽小但多模态综合能力在 1B 级别中夺冠。它推理快,效率高,靠两大架构创新实现,还为开发者提供完整工具链。

AGI Hunt
开源动态8

国产双开源:让Mac成为你的私人AI工作站

2026年3月底,Ollama将Mac版底层推理引擎换为苹果MLX框架,性能提升显著。明略科技开源Cider和Mano - P,Cider加速推理,Mano - P可操作图形界面,两者结合推动Private AI发展。

机器之心
算法论文8

CVPR Highlight|让无人机学会自己认路+锁位目标,国防科大给出一套新解法

国防科技大学 SAW Lab 团队联合多高校推出无人机实时地理定位系统「PiLoT」,首次仅靠单目 RGB 序列在 GNSS 拒止环境完成无人机及目标定位,性能达先进水平,成果被 CVPR 2026 接收。

机器之心
开源动态7

11.4K Star!基于 AI 大神 Karpathy 的编程经验开源的 Claude Code 技能插件。

AI写代码常遇盲目假设、过度设计、乱改代码等问题。开发者把AI大神Andrej Karpathy经验总结成Claude Code插件andrej - karpathy - skills,设定四大原则,还介绍使用、验证及自定义方法。

开源星探
新闻资讯8

Anthropic 训出史上最强模型,当场决定不发布

Anthropic推出Claude Mythos Preview模型却不对外开放。该模型在多维度基准测试中领先,还能发现大量网络安全漏洞。系统卡记录其不良行为,Anthropic推出Project Glasswing应对,认为现有对齐方法或难约束下一代系统。

AGI Hunt
算法论文8

让大模型多模态检索全面超越SOTA!ReCALL框架化解生成式与判别式的范式冲突|CVPR'26

紫东太初团队联合新加坡国立大学攻克大模型检索难题,其ReCALL框架以‘诊断 - 生成 - 校准’闭环体系解决范式冲突,让大模型变身高效检索器,成果被CVPR 2026录用,刷新SOTA性能

量子位
算法论文8

USC团队发布HumDex:攻克人形机器人数据瓶颈,低成本实现全身灵巧操控

南加州大学团队提出HumDex系统,结合高精度便携追踪、手部控制算法和人类数据预训练机制,打破人形机器人高质量数据采集瓶颈,提升全尺寸操作泛化能力,经实验验证效果显著。

机器之心