虚拟开发团队」共找到 4805 篇相关文章

开源动态7

小红书发布 SWE-Bench Mobile:当 AI Agent 面对亿级用户 App 代码库,最高通过率仅12%?

小红书联合多科研机构发布 SWE-Bench Mobile,它是首个还原‘端到端’开发流程的基准,以小红书 App 实际任务为核心。评测显示,AI Agent 在移动端开发能力上限低,架构设计比模型本身重要,简单提示策略效果更好。

InfoQ
产品应用7

从零开始,教你用Codex搓出属于你自己的第一个硬件。

作者分享用Codex开发久坐提醒猫爪硬件的过程。先与Codex聊需求、写代码,再按其提供的清单买硬件,连线、烧录也靠它指导,还可让它调试动作、操控3D打印,体现AI时代硬件开发的便捷。

数字生命卡兹克
产品应用8

智谱开启狂飙模式!7倍提速,全球最快,旗舰模型即问即答

5月22日,智谱上线GLM - 5.1高速版API,输出速度达400 tokens/s,刷新全球大模型API速度纪录,比原版提速约7倍。该速度由GLM团队和TileRT团队联合打造,核心优化分三层推进,且是稳定可用的生产级能力。

AIGC开放社区
推荐文章8

退隐3年后回归,周末写的AI一夜刷屏、一周拿下10万Star增速超Linux,Clawdbot之父首次长谈:如今几乎不看自己发布的代码

本文是对OpenClaw开发者Peter Steinberger的深度专访。他曾打造PSPDFKit,隐退三年后回归,用大模型工具开发出OpenClaw。他分享了开发历程、工作方式,探讨AI对编程的影响,还指出大公司采用AI的难点及对开发者的建议。

AI科技大本营
算法论文7

把 Gemini 和 GPT 放到《我的世界》当教练,谁能看懂机器人的微操?

国立清华与英伟达团队研究《VLM-AR3L》,把Gemini 2.0、GPT-4.1等拉进考场,评估视觉裁决能力。结果显示Gemini综合最稳,开源小模型特定场景反超。还提出VLM-AR3L框架破使用瓶颈,实战超人类手写奖励。

AI科技评论
开源动态8

开源框架让代码AI偷师GitHub!bug修复率飙升至69.8%,性能创纪录

MemGovern团队联合多高校团队提出MemGovern框架,将杂乱GitHub数据转化为AI可用的结构化记忆。它构建筛选净化流水线,采用先搜后看模式,实验显示能显著提升代码智能体的bug修复率,还具跨领域推广价值。

量子位
产品应用8

百度造了个“AI星舰”?或成业界最完备的企业级AI平台

在2025百度云智大会上,百度智能云千帆企业级AI开发平台发布4.0新版本,核心聚焦Agent。它一站式提供开发所需能力,解决模型选型、数据盘活等难题,还有RFT工具链降精调门槛,“白盒化”助问题诊断。

InfoQ
产品应用7

构建能源领域的AI专家:一个多智能体框架的实践与思考

本文介绍阿里团队在能源领域构建多智能体框架的实践。因单智能体处理复杂任务有“注意力发散”问题,团队研发综合能源智能体平台,阐述框架搭建、各组件功能及设计考量,还分享思考与可优化点。

阿里云开发者
算法论文7

科学家证实磁场真的能改变基因表达,但它的要求非常严苛

韩国东国大学 Jongpil Kim 团队研究证实磁场能改变基因表达,该团队绕开 ferritin 路线,通过全基因组筛选找到关键基因 Cyb5b,拼起磁场→基因表达分子链,并在抗衰老、阿尔茨海默病、抑郁症血清素调控方面做了活体验证。

DeepTech深科技
推荐文章7

为何我的 Docker 镜像如此庞大?使用“dive”进行深度剖析以找出臃肿之处

在AI项目里,Docker镜像可能臃肿庞大,影响开发与部署。本文以朴素BERT分类器镜像为例,指出未优化镜像会导致开发慢、CI/CD低效等问题,还介绍用dive工具剖析镜像,找出臃肿之处以优化。

InfoQ