代码生成基准」共找到 4192 篇相关文章

开源动态8

AI地理学家诞生:麻省理工、斯坦福用多智能体框架重塑地理空间建模,刷新SOTA

麻省理工、慕尼黑工大及斯坦福AI实验室发布GeoEvolve框架,深度融合地理知识与进化算法,实现复杂地理空间模型自动发现与优化。经实验验证,其性能超越以往基准,有望在多领域发挥作用。

AIGC开放社区
算法论文8

仅需10%思维链标注,等同全量性能!中科院发布推理监督新范式

中科院计算所团队提出新框架PARO,让模型学习固定推理模式自动生成思维链,只需标注1/10数据就能达全量人工标注性能,适合规则清晰领域,为推理监督提供新思路。

新智元
新闻资讯7

DeepSeek“极你太美”bug,官方回应了

DeepSeek V3.1调用API开发时输出常现“极”字,在火山引擎、腾讯CodeBuddy等多平台出现,影响代码编译。官方称将在近版本修复,网友猜测或因数据清洗不彻底。

量子位
开源动态8

字节突然开源Seed-OSS,512K上下文碾压主流4倍长度!推理能力刷新纪录

字节跳动突发开源360亿参数的Seed-OSS-36B,呼应OpenAI开源策略。它有512K超长上下文,引入“思考预算”机制。多项基准测试达开源SOTA,字节Seed团队此前也开源多个项目。

量子位
产品应用8

实测谷歌AI故事书,我实现漫画和绘本自由了

谷歌Gemini推出免费StoryBook工具,30秒左右可生成10页故事书,支持中文且内容有趣。测试显示,它在图像风格、故事创作上表现出色,还能作学习和展示工具,获网友好评。

量子位
算法论文8

AI「偷学」你的数据?6大顶级机构联手提出数据保护4大分级体系

生成式AI普及,数据保护成挑战。来自多机构研究者发布论文,提出全新数据保护分级体系,分为数据不可用、隐私保护、可溯源、可删除四级,还探讨了技术、法规及面临的挑战。

机器之心
算法论文8

ACL'25 | CIGEval:一种基于多模态大模型的可控生图评测智能体

阿里国际AI团队提出CIGEval,这是基于多模态大模型驱动的图像生成评估智能体框架。它集成多功能工具箱,通过任务拆解与工具调度提升评估准确性与可解释性,已在ComfyUI - Copilot上线。

PaperAgent
算法论文8

何恺明等降维打击!彻底颠覆AI生图,无需预训练一步到位

何恺明团队推出生成模型MeanFlow,它跳脱传统训练范式,无需预训练等,仅一次函数评估就能完成生成。在ImageNet 256×256上表现优越,缩小了一步与多步模型性能差距。

新智元
新闻资讯8

刚刚,GPT-6正式发布!OpenAI:欢迎来到AGI时代

OpenAI正式发布GPT - 6 Astra和GPT - 6 Astra Pro,宣布AGI时代开幕。该模型训练规模大,能力升级显著,价格公布。基准测试成绩优异,在多方面表现突出,还展示诸多实际应用案例,已有企业开始测试。

量子位
产品应用8

香蕉和GPT Image之外的第3条路:华人15人团队造出AI生图黑马

一支不到15人的华人团队推出AI生图模型Uni-1.1,在Arena.ai榜单冲进全球前三。它将推理和生成融入同一模型,创意可控,价格低,已获阿迪等企业认可,未来将拓展到多模态系统。

量子位