「性能 - 效率权衡」共找到 2927 篇相关文章
Tilelang-1: Introduction
文章围绕TileLang展开,指出高层框架抽象层次高,难以满足算法创新和精细控制需求。TileLang将数据流与调度解耦,在易用性和性能间取得平衡。通过实例展示其语法和编译流程,实验表明它在多任务上超越现有方法。
打破日韩技术垄断,看国产高端MLCC如何赋能AI机器人
随着数智浪潮到来,AI 赋能的机器人革命正揭开产业变革帷幕。MLCC 作为核心被动电子元器件,已渗透至现代机器人架构中六大关键模块。不同类型机器人对 MLCC 性能要求不同,微容科技构建差异化产品矩阵,打破日韩技术垄断。
提示词注入攻击的检测和数据集介绍
提示词注入攻击是攻击者操纵AI系统的技术,OWASP将其列为2025年大模型应用风险首位。Meta发布测试数据集,还有多个工具和数据集可用于评估。防护可用AI防火墙,Meta开源小模型。还提到安全性与实用性权衡。
断网可用!首款全双工全模态大模型技术报告发布,附一键安装包
面壁智能等联合发布MiniCPM-o 4.5技术报告,它是业界首个端到端全双工全模态大模型,采用Omni - Flow架构。同步推出在线Demo、API、端侧安装包等,低显存GPU即可运行,性能表现优秀,应用潜力大。
Harness Engineering:AI 能在真正"出事会炸"的后端系统里写代码吗?
文章围绕AI能否在后端系统写代码展开,以腾讯CDN LEGO项目为例,介绍了项目背景与挑战,通过nonstop项目探测AI编码能力,分析AI Coding易翻车的问题及根因,构建Harness Engineering架构并实践,最终效率提升20%。
TEN VAD 开源:低延迟、高准确率,提升「语音 Agent」上限就靠它!
TEN-VAD是专为实时流式语音场景优化的开源模型,能解决语音交互中常见问题。它轻量级、跨平台、高性能、低延迟,获大佬背书,在多场景是必选组件,是语音交互里易被忽略却难替代的一环。
曾经年薪百万的架构师,如今是否要靠AI保饭碗?对话5位顶尖架构师:未来的架构师,不写代码也得懂AI
本文围绕AI时代架构师角色转型展开深度对话,多位专家认为AI引发架构师角色定位转变,架构师需将重心转向战略层面,新职业形态涌现。AI提升架构治理效率,也带来范式变化,架构师应积极拥抱变化。
预训练就学会思考!字节、北大等用14亿参数,撬动百亿模型推理能力
字节、北大等联合发布Ouro模型,用14亿参数实现百亿级模型推理能力。它在预训练阶段学会循环思考,通过三大创新构建推理能力,在基准测试中表现优异,实现参数效率提升,是潜在推理范式的胜利。
此芯科技亮相世界人工智能大会,以 AI 之力勾勒美好未来
2025年7月26日,世界人工智能大会在上海启幕,此芯科技携多款搭载此芯P1的展品亮相,展示端侧AI前沿成果。此芯P1芯片性能强劲,已产品化。展会展示三大应用场景,呈现其多场景应用能力。
首创Mid-training范式破解RL奥秘,Llama终于追平Qwen!
上海创智学院和上海交通大学研究团队深入探讨不同基础语言模型在强化学习训练中的差异,提出中期训练策略,将 Llama 改造成适配 RL 的推理基础模型,缩小与 Qwen 性能差距,还发布了 MegaMath-Web-Pro-Max 数据集。