「高被引科学家」共找到 3748 篇相关文章
硅谷惊变:12万张H100的挽歌
这是虚构故事,Meta用12万张英伟达H100训练“LLaMA 4 Maverick”,却被中国杭州DeepSeek团队用2000张GPU打败。项目失败成丑闻,扎克伯格成立实验室四处收购遇冷,新负责人管理混乱,实验室乌烟瘴气。
天下武功,唯快不破:LLM高效架构最新最全面综述
大型语言模型虽成就辉煌,但训练成本高、推理延迟大,核心问题源于Transformer架构。这篇综述论文首次系统性梳理高效LLM架构创新方案,分类七大类方法,延伸至跨模态应用,为研究者提供‘效率蓝图’。
刚刚,Claude Code 发布限速令,下月生效
Anthropic宣布8月底为Claude Pro和Max订阅用户推新的每周使用限制,因其受欢迎但部分用户使用过度、成本高,还有违规共享账号情况。此决定引发网友不满,有人考虑换替代方案。
ChatGPT正测试神秘功能
ChatGPT正测试名为“Study Together”的新功能,已出现在部分订阅用户工具列表。它或更多提问题让用户回答,似回应谷歌LearnLM,还可能支持多人学习小组模式,有望减少其被滥用可能。
吴恩达:AI 将最先杀死前端
AI 对程序员的影响引发热议,吴恩达在 Newsletter 中给出加速排序:前端 > 后端 > 基础设施 > 科研。他认为前端开发被加速最厉害,后端需更多人工引导,基础设施和科研领域 AI 作用有限。同时指出初级、缺乏协作和创造性的工作易被取代。
后Scaling Law时期的模型、token和组织 | 5Y Quarterly
文章是五源2026年第二季度回顾,涵盖对AI多方面观察,如token军备竞赛、模型资产价值、公司组织成护城河等,还提及被投企业上市、融资情况及五源资本获多项行业荣誉。
700多个「坏模型」喂出AI测谎仪?Anthropic审计神器让AI自曝黑料
Anthropic故意训练近700个「有问题」模型,训了LoRA适配器(IA)让模型自报家门。IA在AuditBench平均成功率59%,但也存在幻觉、成本高、训练分布无指南等局限。
微软的prompt压缩方案-LLMLingua,开源
使用大语言模型时,提示信息长会致运行慢、费用高、易超限。微软推出的LLMLingua可压缩提示信息,有完整开源。它历经多版本演进,还能用于安全防御,使用简单,值得开发者跟踪。
求医十年,病因不明,ChatGPT:你看起来有基因突变
一位Reddit网友分享,自己求医十年病因未明,ChatGPT分析出是基因突变。此帖热度高,很多人分享类似经历。AI在医疗诊断有优势,但不能盲目信,最终诊断还需人类医生。
Claude杀入Office全家桶,全球4.5亿打工人一夜变天!OpenAI惨烈出局
微软推出办公神器Copilot Cowork,全面接管Office。它内置Claude模型,能执行任务、运行工作流,可处理日程、会议准备等场景。微软采用多模型策略,抛弃OpenAI,Copilot Cowork适合企业,价格较高。