「工程效率」共找到 1865 篇相关文章
英伟达新架构引爆全模态大模型革命,9B模型开源下载即破万
英伟达推出全模态大模型OmniVinci并开源,其90亿参数规模性能超同级别甚至更高级别模型,训练数据效率是对手6倍,能精准解析视频和音频,在多模态应用场景中表现卓越,下载量破万。
CUDA-MODE第77课课程笔记:用于GPU kernels的DSL
该课程笔记由Tri Dao介绍GPU kernel开发的DSL生态,涵盖PyTorch、Triton、Cute - DSL等。提出计算效率评估公式,对比不同DSL在Softmax、GEMM等操作的性能。还提及其他DSL工具与Triton扩展项目,并给出使用建议。
光刻机巨头变身AI金主,Mistral AI成欧洲估值最高初创企业
法国初创公司Mistral AI在2025年9月完成20亿欧元融资,估值达140亿美元,成欧洲估值最高科技初创企业,由阿斯麦牵头投资。该公司技术实力强,模型参数效率高、架构创新,还注重开源和多语言支持。
大模型再爆弱点!旧记忆忘不掉,新记忆分不出,准确率暴降 | ICML'25
弗吉尼亚大学和纽约大学研究人员用「前摄干扰」概念设计测验PI - LLM,测试大语言模型(LLM)上下文检索能力。结果显示,随干扰增加,模型准确率对数下降至零,提示工程效果有限,需调整模型架构或训练范式。
狂揽 11.8K Star!用大厂 PUA 话术「驯化」AI,这个项目把 Claude 逼成了卷王!
GitHub上名为PUA的项目狂揽11.8K Star,作者用大厂PUA话术‘驯化’AI,总结了AI的‘五大摆烂行为’,建立‘心理学框架’,实测数据显示能提升AI编程效率,还介绍了安装方式和常用命令。
实测最强的Cowork Agent模型M2.7,这是龙虾最好的模型搭子
实测MiniMax新发布的M2.7模型,解决了Agent的笨拙感,是国内最强的Cowork Agent模型。它技能命中率高,能自进化,对办公场景做了优化,还能解决生产效率问题,加强了人设保持能力。
万亿参数狂欢!一文刷爆2025年七大顶流大模型架构
文章深入剖析2025年顶级开源模型的创新技术,介绍了DeepSeek V3/R1、Kimi 2、Qwen3等七大顶流大模型架构,揭示滑动窗口注意力、MoE和NoPE如何重塑效率与性能。
Meta“Token榜”逼疯打工人,一夜烧掉公司几万刀!AI时代Token焦虑越来越离谱
据报道,Meta 公司内网出现 AI token 消费排行榜,追踪超 8.5 万员工 token 使用情况,过去 30 天消耗超 60 万亿 token。这反映“Token 最大化”文化,引发 token 消耗是否等同于生产力的争议。当前 Agent 系统高 token 消耗是补偿机制,应提升使用效率。
别再设计 Prompt,顶尖工程师已经开始写 Loop 了!
2026年6月,“Loop Engineering(循环工程)”一词热门起来。其核心主张是不用再亲自给AI写提示词,而是设计驱动Agent的循环。Anthropic的工程师还写成了完整手册,介绍搭建方法、关键及最佳实践等。
告别“氛围编程”:基于 Harness 治理和 SDD 的团队级 AI 研发范式演进与实践
本文作者王树新分享团队级AI研发范式演进与实践。指出AI Coding存在自由发挥、效率降低、关键信息丢失问题,分析出码率提升却未提效的原因,引入SDD与Harness解决问题,并介绍全流程自动化实践。