「AI内容新规」共找到 11569 篇相关文章
一起聊聊Nvidia Blackwell新特性之低比特GEMM
本文是NVIDIA Blackwell架构GEMM研究系列文章第三部分,介绍低精度计算,探讨Blackwell GEMM如何执行,关注6位和4位格式及对内存布局影响。还提及低精度优势、数据格式、UMMA实现、操作限制、CUTLASS抽象方式等。
教程 | 如何做出 X 上爆火的 AI 蓝图动画
作者受X上爆火的Midjourney风格代码启发,分享恐龙主题短片制作方法。介绍风格代码功能,还讲了控制画面配色技巧,最后给出复杂动画prompt示例,推荐找风格代码的作者和网站。
突发!Cognition宣布收购Windsurf:看上的还是AI人才
Cognition宣布收购Windsurf,旨在构建软件工程未来。此次是全面整合,获其核心产品、IP、强劲业务、庞大用户基础及顶尖人才。Cognition还提供员工保障方案,战略协同有望变革软件开发模式。
充分激发模态协作,MokA量身打造MLLM微调新范式
当下多模态大模型微调多「照搬」单模态微调策略,忽视模态差异。中国人民大学和上海人工智能实验室团队提出 MokA 方法,兼顾单模态与跨模态建模,在多基座、多场景实验中显著提升性能。
向量数据库要被取代?DynamoDB 开始原生支持 AI 搜索
Amazon DynamoDB 推出原生向量搜索,允许开发者将嵌入向量与应用数据存一起,直接在其中运行近似最近邻查询,无需单独向量数据库。介绍了功能特点、成本计费及开发者反馈等。
一种用于管理 AI 变革步伐的演进式架构模式
Cloudflare推出基于QuePaxa共识算法的Meerkat服务,可无领导者写入并保持强一致性,提高网络可用性。它预计将是QuePaxa全球首次生产部署,但存在局限性,如大量往返通信。
文生图Scaling新变量,被字节Seed团队发现了
ByteDance Seed团队研究发现,文生图模型中自然语言Caption变长,不意味着模型获更多视觉监督,其信息量更能预测训练损失。团队提出Structured Prompt,从两侧提升文本条件,在多任务上取得显著提升。
Auto-Research「终极大考」:新基准撕下大模型科研伪装
来自多所高校的研究者提出MLS - Bench,用于解决现有Auto - Research评测的归因问题。它含140个真实研究任务,校准受控修改范围,主实验显示当前模型在方法发现上有明显缺口,Auto - Research需更严格评测标准。
AI Infra进阶:如何让大模型输出确定的结果
文章探讨大模型输出确定性结果的问题。指推理引擎底层动态组批与算子调度策略,因浮点加法顺序变化使结果波动。还分析GEMM、RMSNorm等算子影响,给出vLLM实现Batch Invariance的方法。
刚刚,Anthropic切开Claude大脑!AI自发长出类人「意识器官」
Anthropic开源「手术刀」J-Lens,读出Claude未说出口的念头。研究发现Claude自发长出类似人脑「意识」结构J-space,通过多项测试与全局工作空间理论对标,还表现出类似人脑的现象。