「深度确定性策略梯度」共找到 1636 篇相关文章
OpenAI 开发者的 Skill 经验:如何使用评估系统来优化 Skill
文章聚焦 OpenAI 开发者优化 Skill 的方法,指出迭代 AI 技能效果难测,可借助评估系统。介绍了用 Codex 评估的流程,包括明确标准、创建技能、手动触发找漏洞等,还提及不同阶段的评估重点和工具。
AI编程节省95% token,工具调用上限狂飙20倍,开源记忆系统登顶GitHub热榜
Claude - Mem是一款登顶GitHub热榜的持久化记忆系统,直击AI编程助手跨会话失忆痛点。它免费且省token,通过‘三层渐进式披露’架构,常规省90%,测试阶段省95%,工具调用上限提20倍。
联合AI天使会、对接百家顶级VC,「星火计划」正式启动招募
算泥社区联合AIGC开放社区发布「星火计划」,联合AI天使会等对接百家顶级VC,构建全链路服务体系。其有构建资本网络、深度辅导、提供品牌与资源等优势,现向早期项目开放征集。
【AAAI 2026大会特邀报告】从推理到科学发现:AI迈向可精专通才之路
上海人工智能实验室周伯文在AAAI 2026大会提出,当前处于AGI前夕,需通专融合智能。他认为可深度专业化通用模型是实现AGI的可行路径,科学发现是AI前沿,还介绍了SAGE架构及相关成果。
芯片企业突然官宣涨价!
1月27日,中微半导对MCU等产品涨价15% - 50%,称受供应紧张、成本上升影响。国科微也宣布自1月起对KGD产品调价,最高涨80%。国内半导体企业通过价格策略应对波动,深化布局与投入。
重复一下提示词,Gemini准确率竟从21%飙升至97%!
Google Research团队研究发现,重复提示词可让Gemini准确率从21.33%升至97.33%。该策略能提升主流大模型非推理任务表现,在多模型多基准测试中优势明显,且不增加延迟。
Claude Cowork刚发布,就有大佬开源复刻了!支持三方 API,让 AI 帮你干活!
2025年AI关键词是Agent。Claude推出新功能Cowork,定位是‘大众版Claude Code’,但官方版贵且封闭。发布不到24小时,GitHub就有大佬开源复刻版Claude - Cowork,它支持三方API,本文深度剖析其功能与特点。
AgentCPM-Explore开源,4B 参数突破端侧智能体模型性能壁垒
当行业争论30B能否挑战万亿参数时,清华、人大、面壁智能与OpenBMB联合研发的AgentCPM-Explore开源,基于4B参数在深度探索任务表现出色,还开源配套平台,解决小模型性能提升难题。
银杏谷资本陈向明:用“科技第一性原理”看未来|甲子引力
2025甲子引力年终盛典上,银杏谷资本陈向明分享科技投资见解。他指出投资底层逻辑已变,应建立新范式,用“后视镜”“望远镜”“放大镜”做决策,还强调构建投资“生态”,从学科发展找确定性。
Hybrid Model Support:阿里云 Tair 联合 SGLang对 Mamba-Transformer 等混合架构模型的支持方案
文章介绍阿里云 Tair KVCache 团队与SGLang社区在推理框架上支持混合架构模型的工程化实践。分析混合架构崛起原因、面临挑战,阐述内存管理、关键技术优化方案,验证性能,并指出未来演进方向。