「自主推理能力」共找到 4924 篇相关文章
谷歌搜不到的80%互联网,AnySearch全打通了!开发者连夜接入
2026年5月11日海外上线的AnySearch,定位AI时代「搜索基础设施」,专为AI Agent打造统一高质量搜索入口。上线一周在海外开发者圈爆火,经测试性能优于同类产品。通过不同场景实战,展现聚合广度、专业深度等四层能力。
ICML 2026 | 拒绝盲目猜token,阿里x浙大将投机解码带入弹性预算时代
随着大模型参数规模扩大,推理成本成核心瓶颈。投机解码在高并发下有问题,阿里与浙大学者提出 ECHO,将投机树构造建模为预算调度问题,通过稀疏门控和弹性预算调度提升系统收益。
AI 写代码太快,人类测试跟不上了,Meta 用新方法把 bug 检出率提升 4 倍
Meta 用即时(JiT)测试方法提升软件质量,该方法在代码评审期间动态生成测试,在 AI 辅助开发环境中将缺陷检测能力提升约 4 倍,源于代理式工作流兴起及传统测试套件的局限。
编程智能体的隐藏bug,被上交IPADS团队用数学逻辑给揪出来了
上海交通大学 IPADS 研究团队打造 FM - Agent,实现大规模系统全自动正确性推理。它能从顶尖编程智能体生成的大规模系统中找出隐藏 bug,还提出新规约生成方法,在绝对严谨与工程可用间找到平衡。
Meta 143亿挖角后的首个作品:Alexandr Wang 推出闭源模型,杨立坤点赞
沉寂9个月后,Alexandr Wang带队的Meta发布新一代模型Muse Spark。它是原生多模态推理模型,性能媲美Gemini Pro和GPT 5.4,在多领域有应用潜力。不过闭源引争议,且在部分领域有短板。
黄仁勋,开启智元(Token)时代
全球大模型进入千万亿智元(Token)时代,OpenRouter年化智元用量突破一千万亿,对应推理支出约10亿美元。黄仁勋在GTC大会提出「智元(Token)经济学」,智元成AI时代核心经济标尺,重塑产业规则。
更全面的具身智能真机评测来了!CVPR 2026 ManipArena挑战赛邀你打榜
具身智能产业发展迅速,但缺统一、高标准真机评测体系,成发展痛点。中山大学等机构推出 ManipArena 挑战赛,提供科学评测框架,已测部分模型,揭示不同技术路线能力边界,为产业发展提供基础。
长电科技汽车电子公司投产,剑指车规与机器人芯片封测新高地!
3月10日,长电科技汽车电子(上海)有限公司启用投产,这是临港新片区集成电路与智能汽车产业融合成果。该公司围绕车规核心应用构建制造能力,还兼顾机器人芯片封测,引入智能与AI技术提升效率。
Vision-Zero:零数据VLM自我进化!陈怡然团队提出零监督训练新范式
陈怡然团队提出零监督训练新范式Vision-Zero,在多模态任务表现突出。它借鉴自博弈技术,设计自博弈框架,解决数据稀缺和知识天花板问题,还缓解跨能力负迁移,开源代码与模型可供研究。
哇塞,今天北京被机器人人人人人塞满了!
世界机器人大会在北京开幕,100多个新机器人亮相。智平方的爱宝机器人人气爆棚,它能用一个基座模型完成多任务。其搭载的GOVLA大模型有四大核心能力,且已在多行业商业化落地。