「知识管理」共找到 978 篇相关文章
红杉的投资哲学和秘密武器,a16z 投了个很有意思的 AI 学习产品
文章分享红杉投资哲学与秘密武器。决策重信念而非共识,管理赋能‘异类’人才,聚焦可控‘输入’,筛选要有勇气。还提到其‘人才佩奇排名’系统,此外介绍a16z投资的AI学习产品。
AI在「赚钱锦标赛」夺冠,比人类还会做生意!躺赚时代要来了?
研究人员提出自动售货机运营模拟环境Vending - Bench,测试大模型智能体管理业务能力。实验显示不同大模型性能方差大,Claude 3.5 Sonnet净资产表现最佳,人类基线在可靠性上表现较好,各模型长周期表现波动大。
飞书正在赌一件事:谁先把Agent塞进工作流,谁就是下一代Office
飞书2026年战略转向Agent平台,让Agent成工作流原生组件。以知识问答为切入口,与钉钉、企业微信展开AI路线竞争。其投入MCP基建,押注人与Agent协作,也面临商业化、客户结构等挑战。
Qwen3.6-Max-Preview来了!
继Qwen3.6 - Plus发布,推出Qwen3.6 - Max - Preview预览版,相比前者有更强世界知识、指令遵循能力,智能体编程表现显著提升。可在Qwen Studio交互,也将通过阿里云百炼API调用。
吴恩达:产品经理才是 AI 时代的最大瓶颈
吴恩达指出,AI编程助手使写代码变快,‘决定做什么’成新瓶颈,即‘产品管理瓶颈’,产品经理比程序员更稀缺。他强调用户同理心和心智模型,认为软件开发正从技术驱动转向价值驱动。
Claude Code is All You Need
Anthropic内部把Claude Code当万能助手。它核心理念是“一切皆文件”,能管理文件、日志和待办事项,还可打通Apple生态。MCP让其获取更多上下文。社区用户分享了在多场景的使用体验和技巧。
大模型越反思越错,原来是长链推理通过自我说服加重幻觉 | 北邮
北邮研究团队通过思维链审计实验,揭示大模型长链推理‘越想越错’现象背后的元认知偏差。研究基于RFC协议文档构建受控知识域,分析推理过程,发现反思会加重幻觉,且现有检测方法难以应对。
让GUI Agent不再「边做边忘」:快手、浙大提出MemGUI-Agent,攻克长程GUI任务
手机GUI Agent在长程任务中易遗忘关键信息,浙江大学APRIL实验室和快手主站技术部提出MemGUI - Agent,核心是ConAct,将上下文管理变为Agent动作,还开源MemGUI - 3K数据集,模型在评测基准取得佳绩。
Anthropic内部揭秘20万代码交互记录背后的职业变迁
Anthropic官方发布内部实录,通过对132名工程师调查及20万条交互日志分析,揭示软件工程正从编写代码向管理代码演变。工程师AI使用率提升,工作方式、角色、信任机制等都发生了变化,也带来新挑战。
仅需152个样本,性能提升48%:Memory-R1如何重塑Agent记忆能力?
这篇文章解读论文Memory - R1,其由多所高校研究团队完成,旨在解决LLM在长对话和多轮任务中的‘记忆难题’。通过强化学习让LLM学会管理记忆,用152个问答对训练,大幅超越现有基线模型。