「高超声速进气道」共找到 1984 篇相关文章
原来Grok是36个小时极限卷出来的!xAI创始成员离职后放开说了
xAI前创始成员托比哥爆料,马斯克要求团队36小时内发布Grok。当时团队仅10人,面对半成品,高强度连轴转完成开发,使其走红。还提到马斯克硬核工作文化,虽压力大但成果显著。
了解下 FlashInfer SKILLS 写法
文章介绍 FlashInfer 的三个 SKILL 文件,涉及调试、性能测试、添加新 kernel 等开发场景。如通过装饰器做 CUDA 调试,提供两种计时方式做性能测试,还给出添加新 kernel 的 10 步流程及最终文件清单,实用价值高。
刚刚,微软全新一代自研AI芯片Maia 200问世
微软原定于 2025 年发布的下一代 AI 芯片 Maia 200 问世。它基于台积电 3 纳米工艺,性能强、能效高,是异构 AI 基础设施重要部分,将为多个大模型提供支持,已部署在美国中部数据中心区域。
安全垂类小模型效果能超过大模型?看看以色列Novee的效果
跟踪AI渗透测试等开源应用发现,通用大模型成本高、功能受限。以色列Novee融资5150万美元并发布4B小模型,测试效果超Claude 4 Sonnet。其靠两阶段训练和浏览器反馈提升能力,有投资说明有价值。
中国科技企业出海的6条最新趋势!
作者在美国拉斯维加斯CES展及硅谷调研后,总结了AI和中国科技企业出海的6条趋势,包括Token消耗激增使自研成大势,AI提升消费电子产品溢价,软硬件边界模糊等。
腾讯LLM团队:对下一个 Token 预测的深入剖析,多样性 or 精准度?
最新研究证实RL能增强LLM推理,但成效受限预训练token分布。腾讯LLM部把交叉熵重写成单步策略梯度,用超参压熵,为RL打造‘低熵高信号’起点,经实验验证低熵模型优势明显。
工业级文本转SQL新思路:成本暴降、超3000列超大数据库依然稳健
华中科大与复旦联合发布AutoLink框架,引入自主智能体,模拟人类工程师工作流。在不输入全量数据库模式下,实现对超大规模数据库模式的高精准链接与筛选,以低Token消耗刷新两大榜单纪录。
Cursor 重新定义 Agent:脑子再大,不如会翻书。
Cursor 分享博客指出,Dynamic Context Discovery 效果远好于 long context 方式,开启动态上下文可使总 Token 消耗降 46.9%,还能减成本、降延迟、提准确率,但也存在成本转嫁、工程复杂度高和安全风险等问题。
AI 医疗全景更新:为什么硅谷 healthcare 领域出现了最多的 AI 独角兽?
本文基于对全美700余位医疗行业高管的调研及关键人物访谈,梳理AI医疗落地路径与商业化逻辑。指出医疗行业正推动AI商业化,投资增长催生独角兽,落地呈现“非线性加速”,还介绍了投资格局、应用场景等情况。
罗福莉执掌小米大模型首秀!定调下一代模型,全新MiMo-V2开源还横扫Agent第一梯队
在2025小米人车家全生态合作伙伴大会上,罗福莉首秀解读全新大模型MiMo - V2 - Flash,该模型已开源,采用MoE架构和MTP技术,在多方面表现出色,罗福莉还阐述其设计逻辑与对下一代智能体的看法。