「代码评估」共找到 2305 篇相关文章
5B参数+4060Ti,10秒出图,全流程开源可复现!补齐统一多模态生成编辑的开源版图,让高质量图像生成真正变得更轻量、更普及
近日,多机构联合发布统一多模态生成编辑模型DeepGen 1.0,仅5B参数,集成五大能力,4060ti 16G上10秒出图,多项指标超大4倍工业级模型。团队开源全流程代码与数据,可从零复现。
OpenClaw 走红背后:Agent、AI Coding 与团队协作的新问题
InfoQ《极客有约》X QCon 直播栏目邀请专家探讨 OpenClaw 爆火背后的问题,如 Agent 能否进入研发流程、AI 写代码边界等。专家认为 OpenClaw 并非低门槛产品,AI Coding 需解决可控问题,团队落地要平衡 SPEC 和 Vibe 模式。
年前看到最有深度的AI下半场Agents记忆机制综述
本文是一篇83页的基础智能体记忆机制综述,由27家机构联合发表。提出AI研究范式转变,记忆是填补理想与现实差距的关键。构建三维统一分类框架,介绍记忆操作、学习策略、评估体系、应用场景及未来方向。
全球爆红后,Clawdbot之父2小时深度专访:退休3年后我杀回江湖
新智元对Clawdbot之父Peter Steinberger进行近2小时专访。他分享AI编程工作流,如一天600个Commit、让AI验证代码、用多个Agent并行开发。他还讲述经历,认为AI时代程序员要关注系统架构,强调与AI融合。
前端同事看走眼了,这个“游戏网页”其实全是AI写的!
Kimi K2.5上新,集视觉理解、代码生成等能力于一体,提供四种使用模式,其中Agent集群模式提效显著。实测显示其网页生成、动效理解能力出色,下一代K3模型或用新架构KDA降低计算成本。
DeepInsight x ChatBI:个人Agent助手养成计划
文章围绕将ChatBI打造成个人Agent助手展开,从用户视角拆解使用流程,分析提问、反问澄清、结果验证等环节的困难与解决办法,还提及MCP协议、通义千问3及阿里云百炼服务对Agent开发的助力。
大厂CIO独家分享:AI如何重塑开发者未来十年
阿里云智能集团副总裁、CIO蒋林泉分享AI时代开发者发展。他指出不能用旧有标准评判价值,探讨技术贡献衡量、全栈工程师、提效顺序等问题,强调AI可助力学习和角色创新,还提及招人看重的能力和心性。
AutoDev CLI:打造 AI 生成的 AI Agent 质量保障与验证架构
文章介绍AutoDev CLI,它基于AutoDev MPP架构构建,旨在解决上一代AutoDev智能体测试难题。阐述其起步、迭代、演进、集成过程,实现从AI生成代码到验证、生成测试系统的转变,带来可验证、可演化、可移植的优势。
传统训练效率很低?我们靠 “给模型降噪” 重新审视长上下文建模难题
文章指出长上下文模型处理长文本时易受噪声干扰,提出新评估指标IG分数和“上下文去噪训练(CDT)”方法。实验表明CDT优于现有策略,经其训练的开源模型在长上下文任务中性能媲美GPT - 4o。
小白必读:到底什么是FP32、FP16、INT8?
文章介绍FP32、FP16、INT8等数字存储格式类型。指出它们是评估算力前提,不同格式在精度、范围、内存占用和计算速度上有差异,还提及多精度与混合精度计算,以及不同硬件对格式的支持情况。