工程能力」共找到 3740 篇相关文章

推荐文章8

品味 + 工程思维:AI 时代最难被替代的两件事

AI 时代,最难被替代的是做选择的品味和把结果做稳的工程思维。语法可交 AI,但需有工程思维,它能让使用者把 AI 用好,避免错误和复杂度失控。文章介绍了培养工程思维的方法。

宝玉AI
新闻资讯7

AI「自我复制」能力曝光!RepliBench警示:大模型正在学会伪造身份

英国AISI推出RepliBench基准评估AI自主复制能力,分解为四大核心能力。测试显示当前AI尚不具备完全自主复制能力,但在部分子任务有进展,研究旨在平衡AI发展与安全,为技术变革导航。

新智元
产品应用8

更可靠的主播助理:淘宝主播Agent的Harness工程实战

文章聚焦淘宝主播Agent的Harness工程实战。介绍了Harness基础定义与分层结构,阐述上下文工程、工具调用等八项实战内容,还提及记忆体系特色,强调Harness工程是让主播Agent可用、可控、可演化的关键。

阿里云开发者
推荐文章8

万字长谈丨同济工智院华先胜:工程智能,是 AI 的「成人礼」

雷峰网·AI科技评论对话同济工智院华先胜,探讨工程智能。他认为工程智能是AI与工程深度融合,要从数字走向物理世界,构建体系,实现人机共生,还介绍了研究院成果、灵感计算及操作系统架构等。

AI科技评论
开源动态8

科学能力太强,这个多模态推理「六边形战士」被严重低估!Intern-S1开源登顶

7月26日,上海AI实验室发布并开源「书生」科学多模态大模型Intern-S1,其多模态能力全球开源第一,文本能力比肩一流,科学能力国际领先。它开创「通专融合」新范式,重构科研生产力,引发国际关注。

新智元
算法论文8

超越对数似然:模型能力连续体下的监督微调新范式

论文挑战监督微调(SFT)用负对数似然(NLL)作训练目标的默认设定,提出基于概率的目标家族,引入“模型能力连续体”概念,分析不同目标在不同模型能力下的表现,为模型后训练提供新优化方向。

深度学习自然语言处理
新闻资讯7

GPT-5.4 发布,OpenClaw 要被替代?OpenAI 新模型会自己用电脑了,还顺手把编程能力拉满

今天,OpenAI 发布 GPT-5.4,将推理、编程和计算机使用能力整合,具备原生电脑操作能力,提升了工具使用效率。它成本降低、幻觉减少、编程能力更强,但 API 价格较高。其或与 OpenClaw 抢夺入口。

InfoQ
算法论文8

重新审视SFT的泛化能力:优化动态、数据与模型能力的条件性分析

上海人工智能实验室等联合研究质疑了‘SFT倾向于记忆,RL实现泛化’观点,指出SFT泛化是条件性现象,受优化动态、训练数据、基模型能力影响,还揭示长思维链SFT会带来安全性能退化。

AI科技评论
算法论文7

告别Reasoning模型的“灵光一现”,推理能力可控了

当前GPT - 4o、DeepSeek - R1等大模型推理的‘高级操作’随机触发,不可控。研究者受经典推理三要素启发,教会模型三种‘元能力’,经三阶段训练,模型效果提升,让推理能力可控。

深度学习自然语言处理
新闻资讯8

Anthropic 发布 AI Agent 上下文工程指南

今年6月Andrej Karpathy提出用「上下文工程」取代「提示词工程」。Anthropic发布工程博客呼应此观点,指出构建AI应用重心转向策划上下文。文章详述上下文工程重要性、有效上下文剖析、检索及长时任务应对技术等。

AGI Hunt