「代码生成基准」共找到 4179 篇相关文章
首个完整开源的生成式推荐框架MiniOneRec,轻量复现工业级OneRec!
中科大LDS实验室与Alpha Lab团队联合开源MiniOneRec,是生成式推荐首个完整端到端开源框架。它验证生成式推荐Scaling Law,可轻量复现OneRec,提供一站式训练与研究平台,技术优势明显。
OpenClaw 技术闭门:测试将比代码更值钱,Agent Computer 会是新的硬件形态
OpenClaw 持续发酵,从极客「玩具」变为生产力工具。闭门分享中,开发者们探讨了其在实际业务中的应用。如代码成负债,测试更重要;不同用户对 OpenClaw 认知差异大;Platform Engineering 成工程师核心,还提及 Agent Computer 新硬件形态等。
ICML 2025 | 西湖大学吴泰霖研究员团队:组合生成式多物理场多元件PDE仿真
西湖大学吴泰霖课题组联合多方提出“组合生成式多物理场多元件PDE仿真(M2PDE)”,将仿真问题视为生成式概率建模任务。该成果在多任务测试中表现卓越,被ICML 2025接收。
Anthropic 深夜发布 Claude Design,一句话生成 UI,百亿美元市值 Figma 股价跌了 4.6%
Anthropic 发布新产品 Claude Design,由 Claude Opus 4.7 支持,以研究预览形式向部分用户开放。它定位为设计师“搭子”,覆盖多设计工作流。网友评价高,但也有人指出其生成结果有同质化问题,对传统设计工具冲击待察。
仅4人28天!OpenAI首曝Sora内幕:85%代码竟由AI完成
OpenAI团队揭秘安卓版Sora APP构建内幕,4人团队28天完成从0搭建,约85%代码由AI智能体Codex完成。Codex可自我迭代,在多方面表现出色,但也需人类指导。团队分享了与Codex协作的经验和技巧。
对话清华商宇丨从生成视频到支撑行动,世界模型需要新的评测标准
文章围绕清华团队提出的 WorldArena 评测框架展开。它针对具身世界模型,对过去沿用视频生成的评测逻辑重新审视,从视觉质量和功能性任务两维度评估,推动世界模型从‘生成世界’迈向‘使用世界’。
开源AI黑客Agent,自动检查代码漏洞并修复,离AI编程的全流程自动化不远了。
开源的AI Agent能自动查代码漏洞并修复,是集自动化渗透等功能于一体的安全测试平台。Strix作为开源AI安全测试工具,无需手动渗透测试,支持多类型安全评估,功能强大。
离了大谱,21%的ICLR 2026审稿意见竟是AI生成的?官方回应来了
刚过去的周末,围绕ICLR 2026审稿意见中大量AI生成说法引发热议。潘格拉姆实验室统计显示,21%审稿意见完全由AI生成。ICLR 2026官方回应正讨论应对措施。
面向「空天具身智能」,北航团队提出星座规划新基准丨NeurIPS'25
卫星星座成数字经济时代基础设施,但运行背后规划难题待解。北航刘偲教授团队提出首个大规模真实星座调度基准AEOS - Bench,训练内嵌时间约束的调度模型AEOS - Former,为‘AI星座规划’奠定新技术基准。
大道至简,何恺明团队新作pMF开启像素级「无潜、单步」生成范式
何恺明团队新论文提出用于单步、无潜空间图像生成的pMF框架,直指主流扩散与流匹配模型通病。该框架将v、u和x三个场关联,训练网络把噪声输入直接映射为图像像素,实验表现强劲。