「代码质量」共找到 2166 篇相关文章
没想到,又一个Code Agents瓶颈,被美团&上交大彻底撕开了~
AI写代码能力提升,但打分方法僵化且成本高。上交大与美团论文提出新基准PRDBench,让AI出题人审核,还训练裁判PRDJudge,提升打分准确率与稳定性,促使AI学会‘看懂需求’。
腾讯纯文本LLM训视觉encoder,拿捏图表长视频,达到开源小模型SOTA!
腾讯开源Penguin - VL,直接用纯文本LLM训视觉编码器,跳出传统多模态拼接套路。在2B/8B紧凑参数规模的复杂任务中竞争力强,训练分三阶段,相关代码、模型等已开放。
Sora2还在5秒打转,字节AI生视频已经4分钟“起飞”
字节和UCLA联合提出Self - Forcing++方法,无需更换模型架构或重收集数据集,就能生成分钟级长视频,最长达4分15秒,高质量且开源,在长、短时长生成上性能领先。
吴恩达:AI编程加速开发也埋下大坑,软件测试空前重要
吴恩达认为AI编程虽加速开发,但Agentic编码系统不可靠,会引入漏洞、删除代码等。他给出核心解法,利用Agentic测试,优先测后端和底层架构,还明确测试优先级,前端低、后端高。
3200+ Cursor 用户被恶意“劫持”!贪图“便宜API”却惨遭收割, AI 开发者们要小心了
近日,网络安全研究人员标记出三个恶意npm软件包,攻击Cursor编辑器macOS版用户,下载超3200次。这些包伪装成便宜API工具窃取凭据、替换代码,还凸显供应链威胁,Socket还发现另两个恶意包。
AI Coding 长文分享:如何真正把工具用起来,从原理到实践
本文系统分享高效使用AI编程工具的方法,涵盖底层机制、提升对话质量的方式、实际应用场景,还推荐结合AI的编码最佳实践,旨在助开发者用好AI工具。
狂揽19.7K star!!神级开源自动化神器,拖拽即搞定,上千模版,太爽了!
本文介绍开源浏览器自动化扩展工具Automa,它基于Vue开发,支持Chrome和Firefox。不用写代码,通过拖拽模块搭建自动化流程,功能丰富,在GitHub星标超19.7k,适合非程序员等人群。
“图片秒生”,腾讯混元图像2.0模型正式发布,主打速度和真实感
5月16日,腾讯发布混元图像2.0模型,率先实现实时生图,生图速度快、质量高,能避免‘AI味’。在GenEval基准上准确率超95%,还发布实时绘画板功能,后续将推原生多模态模型。
AI如何看懂足球?上海交大团队打造Multi-Agent系统,全面解析“美丽足球”!
现有足球AI研究存在不足,上海交大团队打造Multi - Agent系统。他们构建SoccerWiki知识库、SoccerBench评测基准和SoccerAgent多智能体系统,该系统多工具协作,实验中碾压GPT - 4,数据和代码将开源。
TypeScript 6 Beta 版发布:开发者受邀升级以迎接 Go 重写计划
TypeScript团队发布6 Beta版,它是过渡版本,专注消除技术债务和标准化,为7生态做准备。7将用Go重写代码解决性能问题。6在默认设置等方面改进,还弃用部分特性,建议开发者升级。