环境搭建」共找到 735 篇相关文章

产品应用7

Harness Engineering实践,做了一个平台让AI一晚上自动评测和优化你的系统

作者分享搭建小平台实现全自动化评测与系统优化的实践,包括创建评测任务、集、报告等,通过钉钉文档、绘报等案例展示操作,还能自动优化系统,不过需系统UI规范、AI Coding含量高。

阿里云开发者
新闻资讯7

Teleport 报告:AI 安全事件频出,背后往往是过度授权

Teleport报告指出,为AI系统授予过度访问权限的企业,安全事件发生率是权限管控合规企业的4.5倍。身份管理体系建设跟不上AI落地速度,精细化权限授予是关键,还给出搭建统一身份层等建议。

InfoQ
产品应用8

对话贝陪科技:好的 AI 陪伴产品,应该让 AI 少说话

贝陪科技创始人黄缨宁分享打造儿童AI陪伴产品「可豆陪陪」的经验。产品让AI少说话,激发孩子表达欲,上线150天后留存率达51%。黄缨宁认为AI陪伴要营造成长环境,还介绍产品定位、使用场景、设计思路等。

Founder Park
推荐文章8

Anthropic:我们如何构建多智能体研究系统

Anthropic分享构建多智能体研究系统的经验,该系统用多个Claude智能体探索复杂主题。介绍了多智能体系统优势、架构、提示工程、评估方法,也提及生产环境的挑战,此系统处理开放式研究任务价值大。

宝玉AI
新闻资讯8

Opus 5通关ARC-AGI-3!Harness正在变成捆住模型的绳子

ARC Prize官方给Opus 5的ARC - AGI - 3成绩为30.2%,但开发者Jeremy Berman让其借助电脑,正确率飙升至96.2%。还开源代码,换用Codex等测试效果差。表明模型强时,简单环境更佳。

新智元
新闻资讯7

390亿美元,全球具身智能第一估值来了!英伟达持续加注中

与OpenAI分道扬镳后,Figure C轮融资获超10亿美元承诺资本,投后估值达390亿美元。资金将用于扩大人形机器人大批量制造与部署、搭建GPU基础设施、启动数据采集项目,助力具身智能发展。

量子位
开源动态8

1.2K Star!终于有工具开始认真解决 AI Agent 安全问题了!

作者深度使用AI Agent时担忧其安全性,GitHub上斗象科技开源的ClawVault项目,上线不久获1.2K Star。它为AI Agent提供多场景安全隔离方案,有分格管理、可视化监控等实用设计,适配Python3.10+环境,安装方便。

开源星探
新闻资讯7

Anthropic:警惕评测排行榜!差别可能只是机器的内存更大,而已

Anthropic发工程博客指出,AI编程评测排行榜上排名前列的模型分差小,而运行环境硬件配置能让分数波动6个百分点。同一模型在不同沙箱策略下分数不同,资源配置影响评测结果,排行榜分数差距或因硬件。

AGI Hunt
新闻资讯7

大模型IMO25数学竞赛成绩公布了

大模型挑战IMO 2025成绩出炉,Gemini 2.5 Pro以超30%总成绩断崖式领先,超出第二名89%。测试由MathArena组织,采用统一环境和双人匿名评估。还介绍了测试模型、题目及模型表现,人类版结果预计本周六发布。

量子位
新闻资讯7

6位前DeepMind老将打造「AI指挥官」,一半成本刷新SOTA

6名前Google DeepMind成员创立Poetiq,搭建元系统让前沿大模型自动生成解决特定任务的策略和模型组合,降低推理成本。其Gemini 3 Pro优化技术在ARC - AGI - 2上创SOTA,成本仅为之前最优方法一半。

新智元