代码修复评测」共找到 2336 篇相关文章

新闻资讯8

OpenClaw 走红背后:Agent、AI Coding 与团队协作的新问题

InfoQ《极客有约》X QCon 直播栏目邀请专家探讨 OpenClaw 爆火背后的问题,如 Agent 能否进入研发流程、AI 写代码边界等。专家认为 OpenClaw 并非低门槛产品,AI Coding 需解决可控问题,团队落地要平衡 SPEC 和 Vibe 模式。

InfoQ
开源动态8

超20万个高质量Skills!浙大等联合推出SkillNet,告别孤立Skill实现自进化

浙江大学联合多家机构推出开源基础设施SkillNet,拥有超20万个高质量Skills。它能让AI智能体告别失忆式工作,将互联网资源和人类经验转化为可执行Skills,构建Skills网络,经严苛评测,在真实场景验证了强大实战能力。

AIGC开放社区
推荐文章8

全球爆红后,Clawdbot之父2小时深度专访:退休3年后我杀回江湖

新智元对Clawdbot之父Peter Steinberger进行近2小时专访。他分享AI编程工作流,如一天600个Commit、让AI验证代码、用多个Agent并行开发。他还讲述经历,认为AI时代程序员要关注系统架构,强调与AI融合。

新智元
产品应用8

前端同事看走眼了,这个“游戏网页”其实全是AI写的!

Kimi K2.5上新,集视觉理解、代码生成等能力于一体,提供四种使用模式,其中Agent集群模式提效显著。实测显示其网页生成、动效理解能力出色,下一代K3模型或用新架构KDA降低计算成本。

InfoQ
新闻资讯8

账上仍有30亿元现金,王小川不下牌桌|甲子光年

1月13日百川智能开源新一代医疗大模型Baichuan - M3,在医疗AI评测中夺冠,超越GPT - 5.2。王小川带领百川转型AI医疗,虽面临挑战但账上有30亿现金,选择院外商业化,预计2027年考虑上市。

甲子光年
产品应用7

DeepInsight x ChatBI:个人Agent助手养成计划

文章围绕将ChatBI打造成个人Agent助手展开,从用户视角拆解使用流程,分析提问、反问澄清、结果验证等环节的困难与解决办法,还提及MCP协议、通义千问3及阿里云百炼服务对Agent开发的助力。

阿里云开发者
推荐文章8

大厂CIO独家分享:AI如何重塑开发者未来十年

阿里云智能集团副总裁、CIO蒋林泉分享AI时代开发者发展。他指出不能用旧有标准评判价值,探讨技术贡献衡量、全栈工程师、提效顺序等问题,强调AI可助力学习和角色创新,还提及招人看重的能力和心性。

InfoQ
产品应用8

GPT-5败下阵,这款中国AI拿下全球第一,众多医生已在用它做诊断

国家卫健委推进“人工智能+基层应用”,基层医生需实用AI助手。未来医生AI工作室的MedGPT在临床“安全”与“有效性”评测击败国际知名大模型夺冠,其两款助手获医生认可,被视为AI赋能基层医疗最佳实践。

量子位
开源动态8

AutoDev CLI:打造 AI 生成的 AI Agent 质量保障与验证架构

文章介绍AutoDev CLI,它基于AutoDev MPP架构构建,旨在解决上一代AutoDev智能体测试难题。阐述其起步、迭代、演进、集成过程,实现从AI生成代码到验证、生成测试系统的转变,带来可验证、可演化、可移植的优势。

phodal
算法论文8

相机参数秒变图片!新模型打通理解生成壁垒,支持任意视角图像创作

S-Lab等机构研究员提出Puffin统一多模态模型,它能整合理解相机参数与按参数生成对应视角图片的能力。通过“用相机思考”和400万组数据训练,解决此前模型问题,还构建相关数据集和评测基准,性能出色。

量子位