星火挑战周」共找到 1117 篇相关文章

算法论文8

视频生成不再「断片」:OneStory给模型装上「选择性记忆」,跨镜头讲故事人物场景始终如一丨CVPR'26

多镜头视频生成挑战大,现有方法有局限。Meta与哥本哈根大学研究者提出OneStory,为多镜头视频生成建立跨镜头记忆机制,可生成连贯长视频,在复杂叙事中保持一致。

量子位
推荐文章8

从 0 到 25 万行:一个 100% AI 编码项目,真正难的不是生成,而是治理

作者分享 Routa 项目用 AI 驱动开发的经验,指出 100% AI 编码项目真正难的是治理。介绍多个工具参与情况,阐述项目长出反馈系统的过程,包括规则入口、上下文收敛、提交前约束及仓库级裁决等。

phodal
新闻资讯8

中国AI创业者重登GTC舞台:杨植麟用技术语言讲了一个智能上限突破的浪漫故事|甲子光年

美国当地时间3月17日,月之暗面(Kimi)创始人杨植麟在英伟达GTC演讲,介绍Kimi技术路线图。他提出开源模型要出色,给出Token效率、长上下文、智能体集群三个概念,还探索了未来架构,且将创新开源。

甲子光年
开源动态8

Transformer创新架构SALA:上下文更长,推理更快

面壁智能发布行业首个大规模训练的稀疏 - 线性注意力混合架构 SALA 及文本模型 MiniCPM - SALA。该架构降低推理开销与显存占用,MiniCPM - SALA 在长文本处理及推理上表现出色,还发起大奖赛探索性能极限。

PaperAgent
推荐文章8

昇腾MindSpeed:分布式训练加速库的创新实践与突破

在2025年QCon全球软件开发大会上,华为工程师郑加利分享昇腾MindSpeed分布式训练加速库。它在计算、通信、显存等多维度优化,提升训练效率,还介绍业界加速库及MindSpeed架构,阐述多种优化策略。

InfoQ
开源动态7

FACTS 基准测试套件问世,用于评估大型语言模型的事实准确性

FACTS 基准测试套件由 FACTS 团队与 Kaggle 联合开发,基于原 FACTS Grounding Benchmark 增加三个新基准,可从四个维度评估大模型事实性。初步结果显示进展与挑战并存,多模态成难题。

InfoQ
算法论文8

告别“一眼定生死”:Agent-as-a-Judge 开启 AI 评估的下半场

过去两年,LLM-as-a-Judge成评估界“黄金标准”,但面对复杂任务力不从心。论文《A Survey on Agent-as-a-Judge》指出,应从单一的大模型裁判进化为具备行动能力的智能体裁判,还阐述了其优势、发展阶段等。

深度学习自然语言处理
推荐文章8

评测也很酷,Data Agent 自动化评测的三层框架与实战

在大模型技术飞速发展下,评估应用效果成难题。字节跳动尹小明分享自动化评测技术,提出三层评测框架,还介绍 Text - to - SQL 及深度研究评测改进,以及评估平台建设,最后展望自动化评测未来方向。

AI前线
新闻资讯7

GPT-5从零提出量子物理新想法,物理学家写成论文已登Physics Letters B

密歇根州立大学物理学家Stephen Hsu在《Physics Letters B》发表量子物理论文,核心思想由GPT - 5提出。论文探讨量子演化线性问题,推导出新算符可积性条件。他还分享与GPT - 5协作过程及体验,对人机协作前景乐观。

量子位
新闻资讯8

海外产业叙事:AMD超威半导体的崛起

文章讲述AMD发展历程,从初创小公司成长为半导体巨头。早期靠模仿生产立足,后获x86授权。历经起伏,苏姿丰时代推出Zen架构处理器逆袭。2025年与OpenAI合作,MI450有望打破英伟达垄断。

芯师爷