自写驱动」共找到 2195 篇相关文章

算法论文8

时空压缩!剑桥大学提出注意力机制MTLA:推理加速5倍,显存减至1/8

在大语言模型发展中,Transformer注意力机制有计算复杂度问题且KV缓存成推理瓶颈。剑桥大学提出MTLA,结合时空压缩策略,提升推理效率,在多任务中表现出色,代码已开源。

机器之心
新闻资讯7

姚顺雨提到的「AI下半场」,产品评估仍被误解

OpenAI研究员姚顺雨提出「AI下半场」重点转向定义问题,评估重要性超训练。亚马逊Eugene Yan发文补充,指出产品评估常被误解,应运用科学方法,践行评估驱动开发,动化工具也需人工监督。

机器之心
开源动态7

居然 11.5K star 了,这个一人公司的秘密项目有啥魔力!

媒体和内容运营重复工作多、效率低。开源项目`AiToEarn`用AI+动化整合内容创作、发布等环节,支持多平台,有11.5k+ star,还介绍了安装使用方法。

开源先锋
推荐文章7

Agent = Model + Harness,一个可能成为2026年出圈的新概念

文章提出新概念Harnesses Engineering,认为Agent = Model + Harness,阐述了Harness的作用、核心组件,还提及模型训练与Harness设计的耦合及Harness工程未来,指出需‘Harness思维’让AI驱动工业革命。

AI工程化
产品应用7

新手入门 | 搭建 AI 模型开发环境

文章为新手提供AI模型开发环境搭建方法,涵盖安装显卡驱动、CUDA、cuDNN、Miniconda、PyTorch、Transformers等,还介绍用Modelscope下载加载模型、PyCharm配置及解决常见问题。

机器学习AI算法工程
产品应用8

谷歌 agent-skills 根治 6 大 AI 编码通病

Chrome团队的Addy Osmani将Google的senior流程入agent - skills,用24个Markdown文件针对AI编码时Agent常犯的6大错误,死补救流程,提升Agent编码质量。

CourseAI
开源动态7

DeepSeek之后:中国开源人工智能生态的架构选择

2025年1月“DeepSeek时刻”,中国开源社区有历史性进展,讨论焦点从模型转向架构与硬件选择。技术架构多元,多模态能力扩展,开源许可宽松,小模型走红,本土硬件采用加快。

Hugging Face
产品应用7

Claude Code也要龙虾化!凌晨床上发条消息,Mac Mini瞬间亮屏狂敲代码

Claude Code团队宣布新增Channels功能,可通过MCP控制会话,首批支持Telegram和Discord。用户能手机远程控制AI代码,目前已灰度测试。不过其功能依赖会话存活,后续或接入更多平台。

新智元
新闻资讯8

谷歌重回铁王座!Gemini 3吊打GPT-5,奥特曼发信承认技不如人

谷歌携Gemini 3和Nano Banana Pro强势回归AI王座,连奥特曼都承认谷歌「反超」。谷歌逆袭原因多样,创始人布林回归打破「大公司病」,CEO劈柴推动「AI优先」,还有研TPU提供算力保障。

新智元
新闻资讯8

扒一扒百度李厂长在《时代》周刊专访里到底说了啥

2025年《时代》周刊年度AI特刊再访李彦宏,探讨AI未来价值诞生位置。李彦宏认为AI进入大众生活临界点逼近,真正机会在应用层,百度“应用驱动”理念具前瞻性,产品矩阵出海成果显著。

MacTalk