高继扬」共找到 1920 篇相关文章

新闻资讯7

原来Grok是36个小时极限卷出来的!xAI创始成员离职后放开说了

xAI前创始成员托比哥爆料,马斯克要求团队36小时内发布Grok。当时团队仅10人,面对半成品,强度连轴转完成开发,使其走红。还提到马斯克硬核工作文化,虽压力大但成果显著。

量子位
推荐文章8

了解下 FlashInfer SKILLS 写法

文章介绍 FlashInfer 的三个 SKILL 文件,涉及调试、性能测试、添加新 kernel 等开发场景。如通过装饰器做 CUDA 调试,提供两种计时方式做性能测试,还给出添加新 kernel 的 10 步流程及最终文件清单,实用价值

GiantPandaLLM
新闻资讯8

刚刚,微软全新一代自研AI芯片Maia 200问世

微软原定于 2025 年发布的下一代 AI 芯片 Maia 200 问世。它基于台积电 3 纳米工艺,性能强、能效,是异构 AI 基础设施重要部分,将为多个大模型提供支持,已部署在美国中部数据中心区域。

机器之心
产品应用7

安全垂类小模型效果能超过大模型?看看以色列Novee的效果

跟踪AI渗透测试等开源应用发现,通用大模型成本、功能受限。以色列Novee融资5150万美元并发布4B小模型,测试效果超Claude 4 Sonnet。其靠两阶段训练和浏览器反馈提升能力,有投资说明有价值。

AI与安全
新闻资讯7

中国科技企业出海的6条最新趋势!

作者在美国拉斯维加斯CES展及硅谷调研后,总结了AI和中国科技企业出海的6条趋势,包括Token消耗激增使自研成大势,AI提升消费电子产品溢价,软硬件边界模糊等。

芯师爷
算法论文7

腾讯LLM团队:对下一个 Token 预测的深入剖析,多样性 or 精准度?

最新研究证实RL能增强LLM推理,但成效受限预训练token分布。腾讯LLM部把交叉熵重写成单步策略梯度,用超参压熵,为RL打造‘低熵信号’起点,经实验验证低熵模型优势明显。

PaperAgent
算法论文8

工业级文本转SQL新思路:成本暴降、超3000列超大数据库依然稳健

华中科大与复旦联合发布AutoLink框架,引入自主智能体,模拟人类工程师工作流。在不输入全量数据库模式下,实现对超大规模数据库模式的精准链接与筛选,以低Token消耗刷新两大榜单纪录。

AIGC开放社区
推荐文章7

Cursor 重新定义 Agent:脑子再大,不如会翻书。

Cursor 分享博客指出,Dynamic Context Discovery 效果远好于 long context 方式,开启动态上下文可使总 Token 消耗降 46.9%,还能减成本、降延迟、提准确率,但也存在成本转嫁、工程复杂度和安全风险等问题。

探索AGI
推荐文章8

AI 医疗全景更新:为什么硅谷 healthcare 领域出现了最多的 AI 独角兽?

本文基于对全美700余位医疗行业管的调研及关键人物访谈,梳理AI医疗落地路径与商业化逻辑。指出医疗行业正推动AI商业化,投资增长催生独角兽,落地呈现“非线性加速”,还介绍了投资格局、应用场景等情况。

海外独角兽
推荐文章7

记录下SGLang 开发,debug的几个技巧第二弹

作者BBuf上次分享后,又带来SGLang开发、debug新技巧。包括开启多线程加载模型权重,介绍SGLang Serve模型短期和长期崩溃的调试方法,还提及逐层NVTX Profiling、查看固定batch_size下Decoding性能等技巧。

GiantPandaLLM