「AI知识工具」共找到 10573 篇相关文章
深度解读《AI 智能体的上下文工程》:构建高效 Agent 的七个宝贵教训
作者解读 Manus 团队文章,结合自身理解总结出构建高效 Agent 的 7 个关键点,如依赖上下文工程、提升 Prompt 缓存命中率等,还给出总结与核心启示,对 Agent 开发有借鉴意义。
7个月翻一番!AI agent能力飙升,METR报告揭示指数级进化规律
非营利研究机构METR报告显示,Agent能力每7个月翻一番,这在9项基准测试中得到验证,任务涉及编程、数学等领域,大模型正迈向高度自动化,且Agent性能提升快,未来处理复杂任务能力或更强。
AGICamp 第 001 周 AI 应用榜发布:DeepPath、AI 好记、Remio 等上榜
2025年6月27日AGICamp在AICon大会发布第001周AI应用榜,上线14个应用。其暂不推日榜,周二发周榜,评论权重高于点赞。还介绍多个上榜应用,鼓励开发者参与,修复Bug并同步进展。
统一框架下的具身多模态推理:自变量机器人让AI放下海德格尔的锤子
当前先进机器人无法像人类自如用工具,现有多模态系统有局限。自变量机器人提出端到端统一架构,以统一表示学习和多任务多模态生成解锁具身多模态推理能力,实现范式转换。
Cursor 定价更新:Pro 不再限 500 次,取消工具调用限制,还推出 $200 Ultra。
Cursor进行定价更新,推出200美元/月的Ultra计划,使用量是Pro的20倍。Pro计划默认改为有速率限制的无限请求,也能切换回旧的500次快速请求模式。还推荐了4个开源LLM微调库。
AI自己给自己当网管,实现安全“顿悟时刻”,风险率直降9.6%
大型推理模型有安全风险,此前监督微调泛化能力有限。SafeKey团队提出创新的SafeKey框架,发现大模型信息“越狱”两大核心,通过双通路安全头和查询遮蔽建模强化模型安全,实验验证其有效性。
人类程序员依然远强于LLM:为什么说 AI 目前还差点火候
Redis之父Antirez的博文指出人类程序员远强于LLM。他修复Redis向量集缺陷时,与Gemini 2.5 PRO交流,虽其有帮助,但人类跳出固有思维解决问题的创造力是LLM难以企及的。
搜攻略到凌晨3点?飞猪AI“问一问”用1张表谋杀废话
作者用旅游方案提示词测试各类Agent产品,多输出废话。飞猪“问一问”旅行Agent却很厉害,能生成实用旅行规划,还给出汇总表格、地图、行程卡片等,考虑全面且细节丰富,还能找特价机票。
开源AI开发生态大洗牌:低代码平台逆袭,传统LLM框架日渐式微
第十届527蚂蚁技术日,蚂蚁对现有开源生态全面剖析,发布2025大模型开源生态全景图。分析显示开源生态有三个主导技术赛道,还总结出七大趋势,为从业者提供生态演进规律参考。
阿里QwenLong-32B:1W+超长Token推理,知识密集型复杂文档高效推理
文章介绍阿里QwenLong - 32B在长文本推理的能力。长文本推理有训练效率低和优化不稳定问题,QWENLONG - L1通过强化学习等解决,还阐述其组件、训练步骤,并给出实战代码及相关链接。