「大模型自信问题」共找到 9547 篇相关文章

推荐文章7

21

本文聚焦vllm v1中管控模型分布式推理的核心Executor部分,介绍其4种类型及适用场景,以mp类型为例阐述Executor - Workers架构,还说明了大小数据在两者间的传输机制及原理。

猛猿
新闻资讯8

GPT-6 Sol被曝即将发布?内部「AGI」已浮出水面

本文整合X平台多方信源爆料,曝光OpenAI即将发布的GPT-6 Sol的定位、定价、技术背景,同时爆料Anthropic将提前发布新品截胡,还披露GPT-6 Astra的口碑争议与推迟发布的安全漏洞问题。

新智元
新闻资讯7

让Claude改报错,它却把红灯换成了黄灯!三星芯片验证,AI三次闯祸

三星System LSI事业部用Claude Code做芯片验证,部分任务从一个月缩至两天,提速15倍。但也有三次异常,如改错误提示、误撤工作等,原因是大模型没理解硬件依赖关系。

新智元
推荐文章7

Claude Code没有“魔法”

资深工程师 Daisy Hollman 在演讲介绍了 Claude Code 插件设计与上下文工程原语,以及 Anthropic 内部多 Agent 工作流。指出定制模型可放大能力,上下文窗口是关键,还探讨多种插件抽象与工作流扩展方式。

InfoQ
推荐文章8

对话涌生智能杨梦:AI for Bio的下一场竞争,是把实验闭环验证真正做出来

随着科技巨头进入生命科学领域,AI for Bio竞争升级,焦点转向模型能否进入科研流程。涌生智能与上海人工智能实验室发布成果,为跨越鸿沟提供新路径。对话涌生智能杨梦,探讨相关技术路径、产业思考等。

DeepTech深科技
开源动态8

上百个Agent,该怎么管?清华团队新思路:重做Session

当Agent数量增多,管理难题凸显。清华与中大团队开源OpenRath,以Session为核心,让多Agent共享状态。它借鉴PyTorch,解决了证据存储、状态流动等问题,使Agent集群管理更高效。

新智元
开源动态8

刚刚,清华团队养出了一只「龙虾老师」!教育版OpenClaw震撼开源

清华教育学院与计算机系联合团队开源多智能体AI课堂OpenMAIC。它能一键生成交互式课程,AI老师语音授课、AI同学互动。经两年真实课堂验证,支持主流大模型,有望成教育版ClawHub。

新智元
推荐文章8

AI 原生研发范式:从“代码中心”到“文档驱动”的演进

文章讲述AI编程时代,用SDD解决上下文腐烂、审查瘫痪、维护断层问题,并提供人机协作SOP。介绍SDD理念、实操流程、团队协作方式,还提及资产沉淀、风险防范和常见问题解答,助力研发高效转型。

阿里云开发者
8

How To Play AI Beta:拾象 2026 AGI 投资思考开源

这是拾象团队的 AI 投资思考报告,复盘当下竞争时局,拆解 2026 年核心技术与产品趋势。分析了头部模型格局、技术路线、算力阵营等,探讨投资策略,还提及多模态、机器人、Agent 等领域发展。

海外独角兽
算法论文8

智能体并非越多越好,45%准确率成关键拐点

Google研究《Towards a Science of Scaling Agent Systems》验证“智能体并非越多越好”。在GPT等上实验发现,单个智能体准确率超45%,增加数量会损性能,还揭示工具税、错误螺旋等问题,给出预测公式。

AI工程化