子任务级可验证性」共找到 2798 篇相关文章

产品应用8

从Vibe Coding到Agentic Engineering:重构后台开发全流程

文章介绍从 Vibe Coding 到 Agentic Engineering 的转变,以真实需求为例,展示后台开发全流程,涵盖需求获取到合入发布各阶段,介绍各阶段工具及操作,凸显 Agentic Engineering 优势,强调人编排、AI 执行的核心理念。

腾讯技术工程
产品应用7

实测Claude Opus 4.7,好好的模型也开始不说人话了。

作者实测Claude Opus 4.7,它已全渠道上线,价格不变。该模型有多处更新,如隐形涨价、视觉能力提升、审美进步,但也出现不说人话的问题,还新增了effort档位、/ultrareview命令和Cyber Verification Program。

数字生命卡兹克
算法论文8

CVPR 2026 | 20步也能稳住画质,这个扩散加速方法不一样

扩散模型推理效率是落地应用的核心制约因素,阿里安全 AGI 实验室 - 御风大模型团队联合浙江大学提出全新扩散加速方法 TC - Padé,在低步数设置下能兼顾生成质量与推理效率,已被 CVPR 2026 录用。

机器之心
产品应用8

360 如何用 AutoMQ 解决千亿级 Kafka 冷读难题

360 集团作为互联网安全公司,业务数据规模膨胀,Kafka 集群运维难题凸显。AutoMQ 存算分离等特性适配 360 需求,360 验证其性能后用于日志检索平台,解决冷读难题,未来将推广到更多业务线。

InfoQ
新闻资讯7

机器人浓度最高的一届春晚后,具身智能离走进千家万户还有多远?

InfoQ《极客有约》X QCon 直播栏目邀请专家探讨具身智能落地卡点。专家认为其虽面临模型泛化、数据采集等难题,但发展乐观。工业场景对通用性需求不大,Agent 架构或成关键,数据和物理交互等方面也有挑战。

AI前线
算法论文8

痛点突破:YOLOv26引入AAttn区域注意力机制,精度提升1.3个百分点

文章介绍YOLOv26引入AAttn区域注意力机制,解决传统机制在复杂场景下的不足。它通过划分特征图区域学习权重,提升检测精度,且实现简单。经实验验证,精度提升显著,还给出实现细节与优化建议。

机器学习AI算法工程
产品应用8

企业级AI Coding的落地方法,都在这本实战手册里了|甲光年

春节后字节上线TRAE企业版SOLO模式,发布《2026企业级AI编程实践手册》。TRAE企业版SOLO模式有自主规划、工具集成、多任务并行等能力。手册沉淀字节经验,提供方法论和场景实践,助企业迈入AI原生软件工程时代。

甲子光年
新闻资讯7

揭秘!腾讯女程序员的上下班生活

“三八”国际妇女节,腾讯程序媛号随机采访女程序员。闫、语心等多位女程序员分享工作内容、穿搭、兴趣爱好等,还谈及小时候梦想与工作联系,以及对AI影响的看法,最后评论区有福利。

腾讯技术工程
开源动态8

OpenClaw 深度解析:一只龙虾凭什么震撼全世界

万字长文深度解析OpenClaw,阐述其核心原理、创新亮点以及对AI行业的深远影响。解读为何大厂难以打造类似产品,剖析简单任务实现困难的根源,还探讨了其设计机制、应用场景、潜在问题及应对策略。

AI科技评论
算法论文8

CL-Bench的故事没有结束,生成式CL-Bench:GENIUS来了

北大团队发布GENIUS,用于评估模型生成式流体智力。它构建含510个样本、20个任务的评测集,测试模型多方面能力。实验显示当前模型流体智力有短板,还提出免训练注意力校准机制提升性能。

机器之心