「自演进评测」共找到 1879 篇相关文章
代码采纳率如何提升至50%?AI 自动编写单元测试实践总结
文章围绕借助Aone Copilot Agent提升AI代码采纳率至50%展开,介绍项目背景、实践方案、执行过程等,阐述Prompt规则生成方法,分析核心价值与效果,总结经验教训,展望未来技术演进和团队能力建设方向。
5分钟上手,无照就能飞:91万「空中F1」已经排到了2027
Jetson公司推出个人飞行器Jetson ONE,号称“空中F1”,亮相2025年UP.Summit并举办飞行比赛。它性能亮眼、安全性高,无照5分钟上手,售价91万,订单排到2027年。此外还介绍了其他飞行器。
后端架构新范式!阿里云专家亲揭:用RocketMQ彻底搞定多Agent异步协同难题
文章整理自阿里云专家演讲,介绍基于 Apache RocketMQ 新特性构建异步化 Multi - Agent 系统,探讨 Agent 间异步通信等机制,指出 Multi - Agent 协同关键,还讲了 RocketMQ 新特性及如何构建异步系统。
本周推荐的5个yyds的Github开源项目!
本文推荐 5 个 GitHub 开源项目,有给容器提供 GUI 支持的 x11docker、AI 证件照制作工具 HivisionIDPhotos、仓库可视化工具 GitDiagram、英语学习应用 TypeWords 和自托管记账应用 ezbookkeeping,各有特色功能。
清华大学x生数科技:从波形到隐空间,AudioLBM引领音频超分新范式
音频超分辨率是提升音频体验的关键技术,但高频细节损失是挑战。OpenAI的Sora 2树立高保真音频生成标杆,现有学术模型有局限。清华与生数科技团队发表两项成果,AudioLBM展现通用高分辨率音频生成潜力。
CAIR开源发布超声基座大模型EchoCare“聆音”,10余项医学任务性能登顶
2025年9月17日,CAIR开源发布超声基座大模型EchoCare“聆音”。它基于超450万张影像数据集训练,在10余项医学任务测试中表现卓越。首创结构化对比自监督学习框架,为AI医疗应用提供创新路径。
AIGC全生命周期业务风控白皮书,从备案到运营的合规与安全实践
2025年《人工智能安全治理框架》2.0版发布,凸显AI安全重要性。数美科技发布《AIGC全生命周期业务风控白皮书》,构建全生命周期业务风控体系,涵盖备案攻略、评测要点、账号与内容风控等,还有实战案例。
深度长文AI一键生成:实测字节扣子空间新功能
文章实测字节扣子空间新功能,它自比「深度长文写作加速器」。从多方面考验,发现其一键总结方便,写论文、分析社会议题、创作抒情内容等各有表现,适合内容创作,但故事创作表现欠佳。
Sora没做到的,LongVie框架给解决了,超长视频生成SOTA
视频生成近年进步大,但生成超1分钟高质量长视频仍难。上海人工智能实验室等机构提出LongVie框架,解决时序不一致和视觉退化问题,还推出评测基准LongVGenBench,该框架在多项指标达SOTA。
从GPT-2到gpt-oss,深度详解OpenAI开放模型的进化之路
OpenAI 近日发布 gpt-oss-120b 和 gpt-oss-20b 两个开源模型,Sebastian Raschka 发布博客对其详细分析,回顾自 GPT - 2 以来 AI 社区进步,还与 Qwen 3 比较,介绍架构、训练、推理等细节。