「批处理不变性」共找到 1336 篇相关文章
创始人强塞AI代码,致开源社区分裂!核心开发集体出走:“你这种强权压制,让人恶心!”
近期,GZDoom 背后的开源社区因创始人兼维护者 Graf Zahl 在代码库中加入未经测试的 AI 生成代码而分裂,抗议者创建了分支 UZDoom。Graf 称只是用 AI 生成样板代码,不影响核心功能,但社区成员认为开源项目不该用 AI 工具。
20%的美国打工人把活儿甩给AI!被替代的是任务,不是岗位
8月6日,Epoch AI联合Ipsos发布职场调查报告,20%美国就业者将工作甩给AI,表明活儿在人和AI间重新分配。AI参与广但不深入,用时情况不一,输出多需修改,先冲击外包工作,且使用不均衡。
调高一档推理强度,成本可能翻几倍:大模型思考原理讲清楚
文章详细讲解推理强度原理,指出其不改模型,只改草稿长度。还说明模型多思考能提高答题准确率的原因,剖析贵和慢的原因,介绍三种控制形态,并给出判断推理强度档位的框架。
黄仁勋曝英伟达养了61个CEO、从不炒犯错员工:CEO是最脆弱群体
黄仁勋在访谈表示英伟达有61个“CEO”,犯错不炒人,称CEO是公司最脆弱群体。他还谈及英伟达发展、用人哲学,预测五年后AI将改变计算机模式,增加工作机会,他本人不喜演讲但为公司尽力。
18 年 SEO 增长经验专家:别再收藏各种 AEO 最佳攻略了,自己动手实验才是做好的关键
18年SEO增长经验专家Ethan Smith与Lenny对谈,指出网上多数AEO信息不准确,做好AEO要自己动手验证。还分享AEO玩法、与SEO区别、优化策略等,强调100%AI生成内容不可行,要优化帮助中心内容。
几毛钱的芯片,利润直追英伟达
苹果曾被小小基带芯片困扰,芯片世界里有很多单价低、工艺要求不高的“小玩意”,但其利润却直追英伟达。如英飞凌、博通,它们靠“人脉”和网络效应赚钱,且所在领域不卷,抱着铁饭碗。
万字长文!大模型LLM推理优化技术总结
文章围绕大模型LLM推理优化技术展开,先介绍LLM推理各阶段、批处理、KV缓存等概念及内存需求,再阐述模型并行、注意力机制优化、模型优化和模型服务等技术,如Pipeline并行、MQA、量化、动态批处理等。
DeepSeek被曝主动叫停了第二轮融资签约
据彭博报道,DeepSeek第二轮融资临门一脚被按下暂停键,原本预计未来几天签署的投资协议暂不签署。这轮融资计划至少募资100亿元,投前估值不低于4800亿元。暂停或因一份内部交流备忘录泄露。
为什么AI总是"记错"你?我们造了一个"合成人生"来测试
现有AI记忆评测只记'事'不记'人',存在数据源窄、不重理解、注入成本高的问题。QuantaAlpha联合高校团队提出CloneMem基准测试,用'数字痕迹'评估AI Clone长期记忆能力,实验有反直觉结论并给出设计启示。
代码基础,情书就不基础
情人节、七夕来临之际,收获370条程序员爱的代码,文章展示其中16条“代码情诗”,展现程序员用代码表达情感的独特浪漫,文末还有分享三行情书赢七夕基金的活动。