「AI工作能力」共找到 11531 篇相关文章
1500 个 PR、0 人写代码:Codex 驱动的百万行级内部产品实践
团队在五个月内开发并发布无人工编写代码的内部测试产品,代码均由Codex生成,效率高。介绍了开发过程,如定义工程师角色、增加应用可读性等,还提及面临的挑战及解决办法,分享实践心得。
Agent当上群主后,群聊变成办事大厅了
文心APP内测“多人、多Agent”群聊功能,像微型“办事处”,能替人办事、支招,效率高。百度文心团队提出Group - MAS攻克技术难关,此功能是全栈技术验证,还将有新玩法。
KTransformers入选计算机系统顶会、与主流框架合作,趋境&清华让「异构」成为推理新范式
KTransformers由趋境科技与清华团队联合研发,是高性能异构推理框架。其论文入选SOSP 2025,还与SGLang合作。它有算子优化等创新,能让CPU与GPU协同,推动推理架构融合,已成广泛复用的底层框架。
狂涨14.4K star!大三学生开发的Github可视化利器,真吊!
开源君介绍`gitdiagram`,这是结合AI与Web开发栈的开源工具,能将GitHub仓库变成交互式架构图。由大三学生开发,获14.4k星标,微软等企业团队采用,性能佳、使用便捷。
刚刚,OpenAI在ICPC 2025编程赛上满分登顶,Gemini也达到金牌水平
在ICPC 2025编程赛上,OpenAI 5小时内解决12个问题满分登顶,其由通用推理模型集成体构成,结合GPT - 5与实验性模型;Gemini解决10个问题达金牌水平,在部分难题表现出色。
Agent全自动搭建代码运行环境,实时更新解决评测过拟合/数据污染问题|微软
长期以来主流代码修复评测基准SWE - bench问题多,制约AI模型能力展现。微软发布SWE - bench - Live,引入新Issue,实现环境自动化构建与更新,打破传统局限,还揭示传统基准过拟合问题。
今天,Claude Cowork大更新!合上电脑,它替你彻夜打工
Anthropic官宣Claude Cowork正式登陆手机和网页端,Chat和Cowork合并成一个入口。Cowork可脱离设备在云端运行,完成工作闭环,还能让用户在看球赛、赶飞机时用手机‘监工’,巨头正抢占普通人办公市场。
我想给 OpenClaw 接上语音,结果有人先做了
作者一直想用语音对接 OpenClaw,却发现「光帆AI」团队已朝此方向发展。他们用 APP 跑通「耳机 + 服务」链路,后续将迁移到硬件。作者体验后觉得交互爽,还介绍了接入方法、安全模式等。
刚刚,OpenAI 再次开源!安全分类模型 gpt-oss-safeguard 准确率超越 GPT-5
OpenAI 开源安全分类推理模型 gpt-oss-safeguard,有 120b 和 20b 参数量版本,采用 Apache 2.0 许可证。它能直接理解策略文档分类内容,推理能力超 GPT - 5,性价比高,虽有局限但仍是开发者利器。
百度文库网盘发布 GenFlow2.0,支持同时调用超 100 个专家智能体
8月18日,百度文库联合百度网盘发布全球首个全端通用智能体「GenFlow2.0」。它支持超100个专家智能体并行工作,解决描述难、等待久等问题,还打通百度生态资源,兼容MCP协议,接入荣耀智能助理。