「推理能力提升」共找到 6171 篇相关文章
华为盘古首次露出,昇腾原生72B MoE架构,SuperCLUE千亿内模型并列国内第一
当前传统 MoE 有专家激活不均衡问题,华为盘古团队提出 MoGE 解决。基于此架构的盘古 Pro MoE 大模型在昇腾集群高效训练,推理性能强,在 SuperCLUE 榜单千亿内模型并列国内第一,赋能业务落地。
1.6K Star!阿里开源 zg:一条命令解决 Agent 时代的本地检索难题。
AI Agent 用 ripgrep 检索常遇难题,因代码命名和自然语言有‘词汇鸿沟’。阿里开源的 zg,将三种搜索能力整合进 CLI 工具,可用于终端与人机交互,还介绍了其安装、建索引及搜索的方法。
一句话搭出9人旅行网站!奥特曼:ChatGPT Work名字起小了
7月26日深夜,奥特曼称用手机让ChatGPT安排长周末旅行,指令跑完了。ChatGPT Work能力强,能处理多种任务,横跨检索、建站等活儿。其底层是Codex技术,有插件、Sites等能力,还能处理家务。
刚刚,Fable 5全球复活!限时7天,额度砍半
Anthropic官宣Fable 5回归,7月1日至7日限时开放,顶配套餐周使用额度砍半。虽更新安全防护,多数编码任务不受影响,但新防护有误伤,且Token消耗快,还拒绝部分正常提问。其自动化率显著提升。
谷歌搜不到的80%互联网,AnySearch全打通了!开发者连夜接入
2026年5月11日海外上线的AnySearch,定位AI时代「搜索基础设施」,专为AI Agent打造统一高质量搜索入口。上线一周在海外开发者圈爆火,经测试性能优于同类产品。通过不同场景实战,展现聚合广度、专业深度等四层能力。
编程智能体的隐藏bug,被上交IPADS团队用数学逻辑给揪出来了
上海交通大学 IPADS 研究团队打造 FM - Agent,实现大规模系统全自动正确性推理。它能从顶尖编程智能体生成的大规模系统中找出隐藏 bug,还提出新规约生成方法,在绝对严谨与工程可用间找到平衡。
Meta 143亿挖角后的首个作品:Alexandr Wang 推出闭源模型,杨立坤点赞
沉寂9个月后,Alexandr Wang带队的Meta发布新一代模型Muse Spark。它是原生多模态推理模型,性能媲美Gemini Pro和GPT 5.4,在多领域有应用潜力。不过闭源引争议,且在部分领域有短板。
黄仁勋,开启智元(Token)时代
全球大模型进入千万亿智元(Token)时代,OpenRouter年化智元用量突破一千万亿,对应推理支出约10亿美元。黄仁勋在GTC大会提出「智元(Token)经济学」,智元成AI时代核心经济标尺,重塑产业规则。
更全面的具身智能真机评测来了!CVPR 2026 ManipArena挑战赛邀你打榜
具身智能产业发展迅速,但缺统一、高标准真机评测体系,成发展痛点。中山大学等机构推出 ManipArena 挑战赛,提供科学评测框架,已测部分模型,揭示不同技术路线能力边界,为产业发展提供基础。
思考已成白菜价?黄仁勋一语成谶,物理学家:人类科研只剩3年
德国物理学家Sabine Hossenfelder预言,3年内熟悉的科学研究将不复存在,因AI能低成本、短时间取代人力。现实中AI已提升科研效率,国家与巨头也在推动,同时它会摧毁旧科研模式并重塑新范式。