科学推理能力」共找到 4755 篇相关文章

算法论文8

边画边想!多模态Reasoning迎来巨大提升!

论文指出文本无法精准表达空间关系,现有视觉语言模型(LVLM)在空间推理上是短板。ViLaSR让模型直接画图推理,经三阶段训练,在五大空间推理测试中表现出色,还开源资源,有望带来机器认知升维。

深度学习自然语言处理
产品应用8

AI搜索MCP服务来了,Agent直接链接实时信息!刚刚,百度智能云打出了张“王牌”

‘Agent元年’进程过半,Agent卡在‘信息断层’瓶颈。百度智能云千帆平台开放百度AI搜索能力,补上Agent实时信息短板。同步登场的千帆4.0多维升级,聚合150+精选模型服务,构建企业级Agent有四大关键要素。

量子位
开源动态7

单Agent时代结束,AI们开始组团上班

月之暗面发布并开源K2.6,重点升级代码能力与多Agent协作的“Agent集群”能力。K2.6在Artificial Analysis上取得全球开源第一,实测能并行交付多格式成果,还展现出强大的全栈应用开发能力

量子位
6

增长密码:大型网站百万流量运营之道

本书深入探讨了大型网站SEO的底层逻辑,从系统能力、协作能力到创新能力,通过作者亲自操盘的成功案例,揭示了大型网站流量增长的秘诀。书中不仅分享了零成本获客的策略,还涵盖了被动式营销的要领,让读者能够快速掌握SEO的核心技巧。

胡勇
新闻资讯7

AlphaGo 十年:哈萨比斯说,Altman 曾把“坦克”停在我的草坪上,我要反击

3月11日是AlphaGo诞生十周年,其改变了围棋和AI行业节奏。2026年3月10日相关活动上,塞巴斯蒂安·马拉比分享哈萨比斯成长轨迹,与刘铁岩交流AGI机遇挑战,探讨哈萨比斯特质、跨学科背景等话题。

AI前线
产品应用8

MiniMax M3 实测:第一流的模型,已经对执行层动手了

文章对 MiniMax M3 模型进行多维度实测。它强化 Coding 与 Agent 能力,能完成长任务,与 Sonnet 4.6 竞技各有优势,多模态能力强,价格有竞争力,MiniMax Code 意在争夺开发者工作流入口。

AI科技评论
算法论文8

让思考更准更长!强化学习新算法FIPO来了

阿里通义实验室Qwen Pilot团队发布系列博客剖析大模型强化学习机制与局限,推出新算法FIPO。该算法引入Future - KL机制,解决‘推理长度停滞’问题,在多项测试表现优异,还介绍招聘信息。

千问大模型
推荐文章8

同样的模型,Claude Code凭什么比Codex强

文章探讨决定 Coding Agent 能力的 6 大核心组件。指出如今旗舰模型‘裸机’能力相近,真正拉开体验差距的是 Harness 工程质量,还开源 Mini Coding Agent 实现六大组件。

CourseAI
新闻资讯8

当黄仁勋反复提起OpenClaw,他到底在焦虑什么?|甲子光年

美国当地时间3月18日,「甲子光年」参加英伟达黄仁勋在GTC 2026的媒体会。黄仁勋多次提及OpenClaw,认为它很重要。英伟达不仅造GPU,还构建AI工厂,试图成为新计算秩序定义者。

甲子光年
开源动态7

DeepSeek|从零构建轻量级vLLM:Nano-vLLM,吞吐量逼近原版,代码仅需1200行

开源的vLLM能提升LLM推理速度和资源利用率。近日,DeepSeek AI俞星凯从零构建轻量级Nano - vLLM,代码仅1200行。它有离线推理等功能,基准测试显示吞吐量逼近原版。

AINLPer