「再思考能力」共找到 3876 篇相关文章
让问题不过夜:交易领域“问诊”Agent实践
文章针对研发支持中的痛点,构建智能Agent系统,将问题抽象为业务答疑与问题诊断两类能力。介绍了系统架构、构建演进、知识体系、质量评估等内容,还展示实战成效,指出当前边界与下一步方向。
【万字长文】Claude Skills完全指南:从概念到实战
这是万字Claude Skills指南,从概念到实战。介绍了Skills是模块化能力包,有渐进式披露设计,对比了与MCP、Subagent区别,阐述其优势。还讲了创建、设计、使用方法及分类体系,提示安全风险并推荐资源。
卧底硅谷AI独角兽60天:没有KPI,自觉996,不接受远程办公
本文揭秘了AI编程独角兽Cursor早期工作氛围。它招人不走寻常路,无KPI但员工自发996。产品聚焦提升专业开发者能力,奉行Dogfooding文化。靠使命驱动,两年成业界黑马,重产品轻利益。
北大发布学术搜索评测ScholarSearch:难倒一众DeepResearch的“开卷考试”
北京大学DS - Lab发布ScholarSearch,这是评估大语言模型学术检索能力的数据集,含223道高难度题目。评估显示现有模型表现欠佳,纯推理模型准确率低,有搜索功能的模型虽有提升但仍不足。
理解归 AI,正确归引擎:从一句话到一条实时数据链路(0代码搭建实时任务)
文章分享直播数据团队搭建AI辅助、指标驱动的实时数据端到端开发系统的实践与思考。从案例介绍用户使用流程,再深入系统内部讲链路构建与演进,阐述设计方法论,最后提出未来规划。
我MiniMax,用实习生处理数据,照样屠榜开源大模型
MiniMax M2屠榜开源大模型,引发社区热议。它在注意力机制、数据处理、思考模式上另辟蹊径,公开技术细节。M2团队选Full Attention,雇实习生处理数据,提出交错式思维链策略,强调实用性和泛化能力。
DPad: 扩散大语言模型的中庸之道,杜克大学陈怡然团队免训推理加速61倍
扩散大语言模型(dLLMs)有全局规划能力,但存在计算冗余。杜克大学陈怡然团队揭示其“草稿纸机制”,提出免训练方法DPad,结合现有技术,能在几乎无损精度下实现高达61.4倍推理加速。
轻量级易开发,8B参数释放大实力!科学多模态模型Intern-S1-mini开源
上海人工智能实验室继7月26日开源后,推出轻量化版本Intern-S1-mini。它是8B参数“迷你模型”,兼具通用与专业科学能力,适合快速部署和二次开发,在多方面表现出色,还降低了对高端计算设备依赖。
MCP技术浪潮中的Agent应用开发新范式
当下,MCP迅速发展重塑AI开发协作生态。太极平台借MCP汇聚多方能力,释放大模型潜能。文章介绍MCP技术、执行细节,探讨其与Agent、Function Calling关系,分析技术生态,还思考了MCP发展变化与局限。
财报里的AI医生「大为」,撬动京东健康价值重估
京东健康AI医生「大为」让用户足不出户解决就医问题。财报显示其已覆盖超1000种病症,“618”服务用户数同比增近4倍,满意率超98%。它凭借数据、场景和履约能力实现问诊到服务落地,并探索长期健康管理。