推理智能体」共找到 5531 篇相关文章

开源动态8

RL缩放王炸!DeepSWE开源AI Agent登顶榜首,训练方法、权重大公开

今天凌晨,Together.ai联合Agentica开源AI Agent框架DeepSWE,基于Qwen3 - 32B模型用强化学习训练。所有内容开源,测试中性超所有开源Agent框架,证明强化学习训练潜力。

AIGC开放社区
推荐文章7

99%的人都不知道:MCP 必须在 Claude Code 外面装

作者分享飞书MCP安装经验,指出MCP要在Claude Code外安装,介绍用Cursor生成安装命令、验证安装、删除服务等技巧,还整理《MCP安装指令文档》,复制粘贴就用。

AI 产品自由
算法论文8

无需训练,即插即用,2倍GPU端到端理加速——视频扩散模型加速方法DraftAttention

高质量视频生成任务中,扩散模型成主流,但DiT模型注意力机制计算量大,成理瓶颈。现有加速法效果不佳,为此美国东北大学等团队提出DraftAttention,可2倍加速理且不损画质。

机器之心
新闻资讯7

印裔1号位删 Karpathy 团队90%代码、算力暴涨 50 倍!马斯克 Robotaxi 10年终上线,30 元乘车体验刷屏

当地时间6月22日,特斯拉在奥斯汀启动Robotaxi试点服务,仅受邀用户参与。其技术基于FSD 13.2.9微调,团队精简90%代码,算力强大。虽面临竞争,但马斯克看好其发展,认为2026年或现超级智

AI前线
算法论文8

刚刚,OpenAI找到控制AI善恶的开关:ChatGPT坏人格在预训练阶段已成型

OpenAI最新论文揭示控制AI“善恶”开关。研究发现训练模型在某领域答错题,会致其在其他领域“学坏”,还找到“毒性人格特征”。同时给出解决办法,让模型恢复正常。

量子位
推荐文章7

【博客转载】Row-Major VS Column-Major

文章探讨行主序和列主序存储多维数组的差异,以及对矩阵乘法性的影响。指出不同存储顺序组合下矩阵乘法的偏好,还通过C++单线程实现和cuBLAS库验证分析,表明优化可减少性差距。

GiantPandaLLM
产品应用8

AI 驱动云上运维革命:腾讯云如何用“云顾问”重塑 SRE

在 AICon 大会上,腾讯云许小川介绍,面对云 IT 服务挑战,腾讯云出「腾讯云顾问」可视化平台,涵盖架构梳理等功。还分享多方面经验,用 AI 重塑 SRE,助力工作数智化升级。

InfoQ
开源动态7

DeepSeek|从零构建轻量级vLLM:Nano-vLLM,吞吐量逼近原版,代码仅需1200行

开源的vLLM提升LLM理速度和资源利用率。近日,DeepSeek AI俞星凯从零构建轻量级Nano - vLLM,代码仅1200行。它有离线理等功,基准测试显示吞吐量逼近原版。

AINLPer
算法论文8

视频扩散模型新突破!清华腾讯联合实现高保真3D生成,告别多视图依赖

清华大学联合腾讯提出Scene Splatter,基于视频扩散模型,从动量视角引导其生成满足三维一致性的视频片段,提升三维场景生成效果,解决了传统方法在单张图片重建三维场景的难题。

量子位
开源动态8

开启端侧长文本时代!面壁全新架构,让小钢炮最快提升220倍

2025智源大会上,面壁智发布MiniCPM 4.0模型,实现行业首个系统级上下文稀疏语言模型创新。它在端侧理任务上表现出色,降低缓存需求,提高运行效,还进行多维度架构创新,是AI领域探索高效率语言模型的里程碑。

机器之心