「运维解决方案」共找到 3107 篇相关文章
把RoPE扔掉,AI更能看懂长上下文!Transformer作者团队开源大模型预训练新方法
Transformer架构核心作者之一Llion Jones团队开源新技术DroPE,可丢弃位置嵌入扩展上下文,解决RoPE长序列处理缺陷,在多模型实验中表现卓越。该团队来自Sakana AI,此前还有相关研究成果。
告别“音画割裂”与“人物崩坏”!AutoMV:首个听懂歌词、卡准节拍的开源全曲级MV生成Agent
现有AI视频生成模型做全曲MV有时长限制、音画割裂和一致性差等问题。AutoMV作为开源多智能体系统,模拟人类影视制作流程,能生成长达数分钟、叙事连贯且音画同步的完整MV。
浙大联手字节:开源大规模指令跟随视频编辑数据集OpenVE-3M
浙江大学与字节跳动合作,提出大规模指令跟随视频编辑数据集 OpenVE-3M,有 3M 样本对。还提出数据构造管线、编辑模型 OpenVE-Edit 及评测集 OpenVE-Bench,小参数量下超越现有开源模型。
用企业级智能体落地,还有谁没踩这四种大坑?无问芯穹的系统性解法来了
企业级智能体落地遇效果、稳定、成本和商业闭环四大难题,无问芯穹推出智能体服务平台,从多方面提供解决方案,并展示SysCoding Agent案例,其基础设施或成企业拉开差距关键。
谷歌DeepMind团队新框架:让AI告别每次从头开始,在任务流中越用越聪明
谷歌DeepMind团队联合伊利诺伊大学提出Evo-Memory框架和ReMem架构,改变大模型只能被动检索历史的现状,让智能体实现终身学习。通过基准测试验证其有效性,实验显示ReMem优势明显,还揭示记忆复用关键因素。
ICLR重磅回应:评审回滚、AC重置、封禁泄密者、严查贿赂串通
自11月27日OpenReview平台曝出重大API漏洞,ICLR 2026超10000篇投稿数据泄露,评审流程熔断。ICLR公布处理方案,回滚评审数据、重分领域主席,封禁泄密者,涉串通论文将拒稿。
以前写文排版60分钟,现在 Claude Code 3分钟
作者分享AI写作系统,用AI梳理复杂逻辑生成配图,进行个性化排版、一键出稿。介绍必需工具如Obsidian、PicGo、Claude Code等,还提供具体配置教程、进阶玩法,如规范写作、生成逻辑图、定制风格。
Zero-RAG,对冗余知识说“不”
文章指出大语言模型知识冗余,RAG 检索效率低。复旦大学邱锡鹏提出 Zero - RAG,能精准识别并剪除冗余知识,砍 30%语料准确率掉点小,检索延迟降 22%,还介绍了其技术方案。
两周复刻DeepSeek-OCR!两人小团队还原低token高压缩核心,换完解码器更实用
两人小团队仅用两周复刻DeepSeek-OCR,复刻版DeepOCR还原其低token高压缩核心优势,还在关键任务上追上原版表现。它完全开源,无需大规模算力集群,训练方案适配中小团队。
刚刚,AI大牛刘威视频创业公司Video Rebirth,完成5000万美元融资
AI视频初创公司Video Rebirth完成5000万美元融资,由刘威博士创立,致力于打造“视频原生的世界模型”。融资用于视频模型迭代等,解决行业痛点,其核心创新机制让模型表现突出。