产品管理瓶颈」共找到 2583 篇相关文章

产品应用7

深度体验DeepSeek Harness,我原谅它涨价了

本文深度体验了DeepSeek Harness,它已发布并开源代码。其一切如模型、工具等皆为可插拔积木,官方内置超百个插件。介绍了安装方法、使用特点,还对比了与Codex差异,认为它是Agent时代的安卓,有望推动自进化。

量子位
新闻资讯7

Anthropic 技术栈里的「五宗罪」由何而来?

Anthropic的Claude模型升级后,用户却觉得不好用。X上帖子指出其存在文本和代码标记、模型能力、定价、长上下文等问题,这些问题卡在生成、计算、上下文和Agent运行时的5个具体位置,导致各方面互相拖后腿。

AI科技评论
开源动态8

深度拆解 Muse Glimmer,24GB 显存跑 30B Agent,Meta 到底做了什么?

昨天,Meta发布约30B参数的多模态Agent模型Muse Glimmer,支持128K级上下文。它采用Apache 2.0许可证开放,有量化版本等。其技术设计围绕显存、上下文管理等问题展开,在多方面做了取舍。

AI科技评论
7

苹果把OpenAI窃密细节全部暴露!但草台班子拼音都搞错了…

苹果与OpenAI窃密大战更新,苹果提交初步禁令申请及相关材料,指控OpenAI员工多次蓄意窃密。OpenAI回怼,称苹果虚构协商叙事,其指控无据,还质疑苹果权限管理。此前马斯克也曾起诉OpenAI。

量子位
开源动态8

全球首个!国产AI开源系统一周狂改百款软件,全程0人干预

中国正从「制造大国」迈向「智造强国」,国产工业软件面临性能瓶颈。面壁智能联合OpenBMB开源全球首个Stencil优化AI系统ForgeStencil,1周自动优化100+软件,全程0人干预,提升研发效率,切中制造业升级诉求。

新智元
算法论文8

LLM后训练太烧钱?清华&腾讯有了破解法门:关键是得会Rollout

大模型强化学习后训练中,rollout预算易成瓶颈,且并非所有rollout都有用。清华和腾讯研究者提出TRACE框架,将Agent轨迹视为树,分配预算给易产生“成功/失败对比”的节点,实验显示其效果良好。

量子位
推荐文章7

翁荔最新博客:我们可能高估了模型,却严重低估了那层“脚手架”

前OpenAI安全研究副总裁翁荔在新博客聚焦AI领域Harness Engineering。她认为Harness是决定模型在现实任务中走多稳、多远的‘脚手架’,并梳理其演进路线,也指出研究面临评估、安全等瓶颈

DeepTech深科技
推荐文章7

第十一章 Deep Agents 实战——数据分析与报告生成

本章介绍构建营销内容 Agent,能分析产品数据、生成营销文案等。核心技术有结构化输出、多 Skill 水平组合、模拟数据分析。还对比传统营销与 Agent 流程,展示结构化输出优势及数据驱动决策方法。

CourseAI
新闻资讯8

人类最后考试已不够用,Agent最后考试来了!

AI飞速进步,人类最后考试(HLE)已不够用,伯克利牵头推出智能体最后的考试(ALE)。ALE真实、全面、可验证,当前最强AI在最难档通过率仅8.6%,主流系统平均2.6%,显示AI距替人干活尚远。

AIGC开放社区
推荐文章8

AI科研全周期拆解:从选题到宣发,哪里能放手,哪里得盯着

Awesome AI Auto-Research Team 综述梳理 AI 科研全周期能力与局限,按四阶段八环节拆解,介绍五种方法范式,指出各阶段应用情况、瓶颈及规律,强调人本治理的 AI 辅助科研才是可信路径。

AIGC开放社区