全栈能力」共找到 4714 篇相关文章

开源动态7

致敬Kimi K2:基于slime的流程INT4量化感知RL训练

受Kimi K2团队启发,SGLang RL团队落地INT4量化感知训练流程方案,在强化学习多方面取得进展,还在slime框架复现流程方案,实现媲美BF16精度,提高Rollout效率,为社区提供开源参考。

机器之心
开源动态8

Qwen3技术报告首次公开!“混合推理模型”是这样炼成的

本文首次公开Qwen3技术报告,介绍其模型架构、预训练及后训练过程、性能表现等技术细节。Qwen3整合两种模式,引入思考预算机制,降低轻量级模型计算资源,在多基准测试领先,多语言支持扩展至119种,所有模型开源。

通义千问Qwen
算法论文8

北航LiveRepoReflection: 扭转乾坤-仓库级代码反射

本文提出LiveRepoReflection基准,评估多文件仓库代码理解和生成能力,含1888个测试案例。创建RepoReflection - Instruct数据集训练RepoReflectionCoder,评估40多个LLMs,结果显示其能有效测模型反思修复能力

PaperAgent
新闻资讯8

ChatGPT智能体正式发布,多个创业赛道昨夜无眠

OpenAI正式发布ChatGPT Agent,将思考与执行能力统一,可接管电脑,能处理工作和生活多种事务。它优化后能力达SOTA,但也有风险。这或重塑互联网,让Agent创业者重新审视竞争力。

量子位
产品应用8

Google Omni首发「AI视频编辑」功能,AI视频的下一种形态终于来了!

Google Omni首发模态AI视频编辑功能,是继Banana后AI圈重大技术进步。它能改变视频内容、重绘风格、多轮修改,支持模态输入,精通物理概念,让AI视频更逼真。

开源AI项目落地
产品应用7

长得这么“乖”的人形机器人,第一次见

北京朝阳,傅利叶发布尺寸人形机器人Care-bot GR-3,外观采用莫兰迪暖调配色等设计,有亲和力。它配备感交互系统,能实现多种拟人行走姿态,未来将拓展至辅助陪护场景。

量子位
新闻资讯7

Anthropic 发布最新研究:LLM 展现初步自省迹象

Anthropic 最新研究表明,Claude 展现出真实但有限的内省能力,能在某种程度上识别自己内部状态。研究团队开发验证方法,通过概念注入等实验进行测试,还发现认知控制证据等,不过该能力有局限。

AGI Hunt
新闻资讯8

刚刚,Bengio官宣创业!急筹3000万专治AI欺骗人类,图灵三巨头下场

图灵奖得主Yoshua Bengio官宣创办非营利机构LawZero,致力于研发「设计即安」的AI系统,以应对AI军备竞赛风险。其研发的「Scientist AI」不具行动性,目标是理解世界,防止人类陷入AI风险。

新智元
算法论文8

大模型外挂“三维物体知识库”来了,大幅增强机器人长程自主操作能力

现有视觉语言大模型(VLM)能让机器人理解指令,但在操作中缺三维空间知识。近日研究提出 RAM 框架,它像“三维物体知识库”,为 VLM 补充空间知识,经 14 项实验验证其操作能力,还探索了在铰接与柔性物体操作中的应用。

DeepTech深科技
开源动态7

教你构建私有 AI Coding 平台:Pi、DSH、Codex Harness 扩展能力对比与选型。

文章聚焦构建私有AI Coding平台,对比Pi、DeepSeek Harness、Codex Harness的架构、扩展能力及选型策略。介绍三者交互集成方式,分析其扩展特点,并为不同需求团队给出选择建议。

AI大模型应用实践