「仿真评测」共找到 720 篇相关文章
Vibe Coding杀进3D领域!OpenAI总裁都在围观这种新玩法
AI 3D 基础模型领先公司 VAST 发布 Tripo P2.0,直接产出原生四边面拓扑,解决生成后模型可用性问题。此外,VAST 完成约 30 亿融资,Tripo 系列在评测中居首。
惊讶!!!3.2 万 Star OpenViking,让你的原地起飞!!!
OpenViking有3.2万Star,它把记忆、文档、提示词等上下文统一成可浏览地址空间,设计三层信息按需加载,检索留轨迹,还接入多种工具。不过它处Alpha阶段,用前要考虑许可证。
一篇论文改写AI科研评价规则!中国公司拿出实践数据,双榜第一、成本更低
今年科技巨头入局AI4S,想打造“AI科学家”。8月19日《Measuring AI Scientists: From Exams to Discovery》论文提出评价范式。深度原理MIRA平台是现实样本,在评测中表现优异,沉淀闭环数据。
模型越强,人的判断力越值钱:微软CEO破解“AI替代”焦虑
微软CEO纳德拉长文探讨‘AI驱动的经济中企业的未来’,指出企业要构建AI学习闭环,让人力资本和AI能力叠加增长。还提出认知闭环概念,强调人的判断力在AI时代更有价值,给出构建学习系统的具体方法。
机器人搬冰箱成了!洗碗之后又一痛点,网友:解放我的髋关节
波士顿动力最新人形机器人Atlas能搬动几十公斤重冰箱。它定位为干重活,动作模拟人类搬重物,训练靠强化学习,经参考轨迹、奖励函数、仿真训练、真机测试迭代。
「虾马」之后,openJiuwen社区发布JiuwenSwarm,引领蜂群智能体新架构,开启「养蜂」时代
华为支持的开源AI Agent平台社区openJiuwen发布并开源蜂群智能体JiuwenSwarm,按下“群体智能”加速键。它基于Coordination Engineering理念,有全栈技术体系,在多领域实战效果好,且单Agent能力强。
ICLR 2026 Oral | 没人诱导,大模型也会「骗人」
新加坡国立大学 Bingsheng He 教授团队论文关注无诱导下大模型是否诚实。设计 CSQ 框架测 16 主流模型,发现问题越难模型越易不诚实,能力强也未必更诚实,还揭示 silent fabrication 现象。
Qwen3.6-Max-Preview来了!
继Qwen3.6 - Plus发布,推出Qwen3.6 - Max - Preview预览版,相比前者有更强世界知识、指令遵循能力,智能体编程表现显著提升。可在Qwen Studio交互,也将通过阿里云百炼API调用。
独家对话Sharpa核心团队:如何把人类的“触觉”装进机器人的身体|甲子光年
甲子光年对话Sharpa核心团队,该团队定位是以触觉AI驱动的全栈灵巧机器人公司。团队认为触觉是机器人灵巧操作关键,介绍CraftNet创新,还提及与英伟达合作及公司运营、商业计划等。
Soul APP 开源首个 14B 实时数字人!0.87秒延迟+32fps,冲进 I2V 趋势榜 TOP5!
AI圈对数字人爱恨交加,因其存在太假、太慢、太僵硬等问题。Soul App旗下AI团队开源实时数字人生成模型SoulX - FlashTalk,参数量14B,有亚秒级延迟、高帧率等亮点,冲进HuggingFace I2V趋势榜TOP5。