「大模型推理加速」共找到 8576 篇相关文章
苹果OS全家桶12年最狠升级!AI入侵一切,唯独Siri没更
春季WWDC开幕,苹果OS全家桶迎十多年最大版本升级,统称OS 26。苹果AI进化,支持实时翻译、看屏搜物等。开发者工具升级,三行代码可调用苹果AI。各系统在设计、功能上均有革新。
5 万行代码 Vibe Coding 实践复盘:最佳实践、关键技术,Bitter Lesson
大厂资深工程师分享 3 个月用 AI 写 5 万行代码的体验,介绍 Vibe Coding 实践,分析 Coding Agent 关键技术如语义搜索、MCP,对比 Cursor、GitHub Copilot、Cline 等产品,还提到 Agent 开发要避免过度植入人类经验。
微软再放LLM量化大招!原生4bit量化,成本暴减,性能几乎0损失
微软公布BitNet v2,性能几乎0损失,占用内存和计算成本显著降低。它首次实现对1比特LLMs的原生4比特激活值量化,通过H - BitLinear模块处理异常通道,实验显示其在多方面表现优异。
Agent 元年,小厂碎步快跑反超
2025 年被视为 Agent 元年,AI 从“助手”走向“员工”。飞猪“问一问”出圈,虽小厂在模型、技术上不占优,但 AI Agent 落地门槛降低,小厂抓住场景和体验,或在 AI 时代弯道超车。
打破资源瓶颈!华南理工&北航等推出SEA框架:低资源下实现超强多模态安全对齐
本文介绍北航彭浩团队的 SEA 框架,针对多模态大模型低资源安全对齐难题,用合成嵌入替代真实数据,突破资源瓶颈。还构建 VA - SafetyBench 评估安全风险,实验验证了 SEA 低资源、高泛化优势。
AI重塑搜索:夸克“深度搜索”如何定义下一代信息入口|甲子光年
大模型发展推动搜索产品革新,“搜索”变“深度搜索”。夸克升级AI超级框发布“深度搜索”,即将推出“深度搜索Pro”。其“深度搜索”情商高,“深度搜索Pro”免费、快速、专业,夸克正打造AI全能助手。
CVPR2025|MCA-Ctrl:多方协同注意力控制助力AIGC时代图像精准定制化
中国科学院计算技术研究所团队提出无需微调的通用图像定制方法 MCA - Ctrl,利用扩散模型内部知识,结合条件语义与主体内容。实验显示其在编辑和生成任务表现优,解决了现有技术瓶颈。
从游戏少女到AI女神!她用物理驯服AI,让飓风预测快1000倍
本文讲述了AI领域领军人物Rose Yu的成长历程,她从玩游戏起步,到用物理知识改进交通预测、加速飓风模拟,还设想打造“AI科学家”辅助科研,强调AI是助手而非替代者。
本地版Jev 1G内存就能跑!四舍五入等于不要钱啊
Jev爆火一周后,开发者推出适配Apple MLX框架的Laya-MLX,是开源决策模型Laya的原生本地版,最低仅需不到700M内存即可在Mac运行,速度快准确率高,适合高频短决策任务。
刚刚!OpenAI与Anthropic CEO罕见同台,黄仁勋当场唱反调:AI到底要不要踩刹车?
Salesforce Dreamforce 2026大会上,OpenAI、Anthropic、英伟达三大AI巨头CEO罕见同台,围绕AI发展是否需要踩刹车展开激烈论战,各方立场背后暗藏产业利益博弈,头部模型厂商已密谈行业安全协同。