「评估策略」共找到 1560 篇相关文章
OpenAI解散「灾难风险应急」团队!GPU大神Scott Gray也跑路了
OpenAI解散「Preparedness」团队,该团队负责评估自家AI灾难级社会风险。官方称安全工作已融入开发流程。此前多个安全团队也已解散,多名安全高管离职,引发员工不安。
刚刚,DeepSeek Harness震撼开源:一切皆插件
今天凌晨,DeepSeek Harness(开发者预览版)开源。它是构建智能体的SDK与框架,设计理念为“一切皆插件”,代码量大且模块化,通过配置文件组装不同智能体,还具备多方面创新设计和安全策略。
王炸!模型越接越乱,2.9 万 Star OmniRoute 把 290+ 个 AI 供应商压成一个入口
现在接入AI工具麻烦,换模型要改配置,额度、接口等也有问题。OmniRoute是开源AI Gateway,将多家模型供应商统一到一个入口,支持290+ providers等,可解决接入混乱问题。
翁荔新博客提出「自进化先从Harness开始」,DeepSeek崔添翼转发附议
前OpenAI安全副总裁翁荔新博客探讨AI自进化,提出从Harness开始的现实路径。DeepSeek崔添翼转发附议,认为Harness方向自进化很可能出成果。翁荔梳理研究,展示优化递进趋势,也指出实现递归自我改进存在的瓶颈。
为什么你的 AI Coding 账单越涨越快?十个节约 Token 的工程办法。
文章指出今年大模型Token账单涨得快,尤其AI编程重度用户。从工程角度总结降低Token消耗的方法,如上下文清场、代码导航等,还分析AI Coding的Token变贵原因及各方法适用边界。
SIGCOMM 2026 | 从「人眼看视频」到「AI理解视频」:北大提出面向AI的实时通信框架Artic
AI 正从「文字聊天」走向「边看边聊」,传统实时视频通信难以满足需求。北大团队提出 Artic 框架,重构码率自适应等,实验显示其能显著提升准确率、降低延迟。
我们开源了一个可以降低 AIGC 率的模型
毕业季学校查 AI 率,作者为降 AIGC 率,经尝试不同路径后训练出模型。介绍训练数据和过程,包括 SFT、DPO 各阶段,展示改写效果,还开源模型和数据,最后引发对教育检测的思考。
Anthropic发布AI原生创业秘籍:手把手教你怎么烧Token创业
Anthropic发布36页AI原生初创企业操作手册,将创业精准拆解为四阶段,剖析如何用Claude Code构建商业护城河。介绍各阶段任务、退出条件、常遇问题及应对策略,强调创始人判断能力重要性。
Figma 自研了 Redis 代理,实现六个 9 可用性
Figma发布自研Redis代理服务FigCache详细实践,替换旧缓存栈。自2025年下半年上线,实现六个9可用性。它基于ResPC构建,分离前后端,配置灵活,处理Redis Cluster问题,迁移策略可回退。
Anthropic开始抢科学家了?周薪2.7万驻场,专治Claude专家级错误
Anthropic新推出STEM Fellow岗位,招募STEM领域专家驻场三个月,周薪3800美元,用其判断力校准Claude输出质量。其三年来科研路线不断加码,正构建科研生态。AI科研瓶颈是判断力而非算力。