「善意的混乱」共找到 10742 篇相关文章
通用LLM压缩算法,居然藏视频编码里!2.5bit实现4bit性能,硬件无缝支持
LLM.265研究发现,视频编码器是高效的大模型张量编码器,现成视频编解码硬件压缩AI模型数据效率高。它灵活控制码率、可压缩多种张量,还能利用GPU硬件加速。实验显示其压缩效果显著。
来了,DeepSeek又悄悄开源LPLB项目
DeepSeek 悄悄开源 LPLB 项目,该项目解决 MoE 小批量训练专家每批 token 数抖动问题。LPLB 在 EPLB 基础上,将‘冗余专家’看成带容量边的图,每批解一次线性规划,实现 token 重新路由,单节点 100µs 级求解。
马斯克抢先谷歌一步放大招,Grok 4.1登顶LMArena,创意写作直逼GPT-5.1
谷歌Gemini 3将上线消息正热时,马斯克旗下xAI的Grok 4.1凌晨上线。它有两个“形态”,免费开放且有APP版。在LMArena测试中表现优异,事实稳定性、情商、创意写作等能力提升,实测也有不错表现。
当AI无所不能,你如何不可替代?
硅谷裁员潮,AI 普及让职场人焦虑被替代。《太稳不太稳》直播中,万维钢与霍太稳探讨人类核心竞争力,指出人类主动性等是 AI 无法复制的价值,还给出各职业应对建议及用 AI 提效方法。
KTransformers入选计算机系统顶会、与主流框架合作,趋境&清华让「异构」成为推理新范式
KTransformers由趋境科技与清华团队联合研发,是高性能异构推理框架。其论文入选SOSP 2025,还与SGLang合作。它有算子优化等创新,能让CPU与GPU协同,推动推理架构融合,已成广泛复用的底层框架。
首个代码世界模型引爆AI圈,能让智能体学会「真推理」,Meta开源
Meta重组后的AI部门推出首个代码世界模型CWM,是320亿参数开放权重LLM。它与传统大模型思路不同,能模拟代码执行。CWM在通用编程与数学任务表现不错,Meta还开放相关检查点以支持研究。
刚刚,DeepSeek-V3.1「终极版」重磅发布!最大提升超36%,V4/R2还远吗?
DeepSeek最新模型DeepSeek-V3.1-Terminus发布,解决了此前输出随机带「极」字、中英文混杂等问题,在多个基准测试中成绩提升,最大提升超36%,Agent能力也有进步,还引发网友对V4/R2的期待。
技术大神用纯Rust从零构建了LLM,在GitHub上大火
Python是AI界宠儿,Rust也因“内存安全、零成本抽象、无畏并发”受青睐。项目RustGPT用纯Rust从零构建LLM,在GitHub上火了。Rust弥补了C/C++和Python的不足,Rust社区LLM项目增多,巨头也在布局。
斯坦福华人天团意外爆冷!AI用纯CUDA-C编内核,竟干翻PyTorch?
斯坦福华人团队用纯CUDA - C编写的快速AI生成内核超越PyTorch,成果登上Hacker News热榜。研究者采用KernelBench任务设置,引入新优化方法,实验显示多数最优内核在靠后轮次出现,优化策略集中在几类常见模式。
首次曝光!OpenAI新一代旗舰Astra换上“循环深度”推理架构:用计算深度换参数规模
9月2日消息,OpenAI将推出的旗舰模型Astra采用“循环深度”新技术,用较小模型实现庞大模型性能,降低成本。但该技术会让AI推理过程不可读,加重安全担忧,此前奥特曼已因Astra“能力过强”踩刹车。