「差分平均引导」共找到 533 篇相关文章
一句话生成任务专属LoRA!Transformer作者创业公司颠覆LLM微调
Transformer作者之一创立的SakanaAI推出Text-to-LoRA(T2L),简化模型适配流程,省却繁琐微调。T2L参数压缩率达80%仅降1.2%准确率,零样本场景平均准确率78.3%超现有SOTA方法,开启“一句话定制模型”时代。
眼馋苹果刚发布的液态玻璃效果?藏师傅教你提示词一键实现
苹果 WWDC2025 发布的液态玻璃效果引关注,虽卡片中心可读性差,但预计会被广泛使用。藏师傅探索出将其融入网页生成的提示词,介绍了在不同模型上的效果及提示词内容和使用注意事项。
刚刚,腾讯姚顺雨署名首篇论文发布,「下半场」先搞上下文学习
腾讯混元团队和复旦联合团队发布姚顺雨署名首篇论文《CL - bench》。论文证实模型在上下文利用上有能力短板,还构建了CL - bench评测基准,评估发现前沿模型在上下文学习上表现差,未来要让上下文学习走向现实。
租了8张H100,他成功复现了DeepSeek的mHC,结果比官方报告更炸裂
元旦期间,DeepSeek发布的mHC震撼AI社区。FlowMode工程师Taylor Kolasinski租8张H100复现mHC,结果比官方报告更优。文章介绍复现实验,对比mHC、HC和标准残差结构,揭示超连接在规模化时的不稳定性及mHC的解决办法。
Anthropic刚发布了一份「AI抢饭碗报告」:学历越高越「被抢」
Anthropic《经济指数报告》揭示,任务越复杂AI加速越猛,学历高的工作受影响大。还指出人机协作能大幅提升任务时长,不同国家AI应用有贫富和技术代差,也提到了‘去技能化’问题及对生产率的预测。
单应计算加速数十倍、计算量减少95%!基于几何的SKS和ACA矩阵分解被提出
东华大学、上海交大和中科院自动化所团队提出基于几何的SKS和ACA单应矩阵分解,计算量比通用方法减超95%,能减少二维码扫描等应用的计算消耗,有望用于多领域,论文已被IEEE T - PAMI接收。
21 页 PDF 实锤 Grok 3“套壳”Claude?Grok 3 玩自曝,xAI工程师被喷无能!
网友 GpsTracker 爆料,xAI 公司的 Grok 3 在“思考模式”下自称是 Anthropic 公司的 Claude 3.5。多种模式测试显示异常回应仅在“思考模式”触发,21 页 PDF 记录也证实其“自曝”。此事引发热议,有人吐槽预训练团队水平差。
打破日韩技术垄断,看国产高端MLCC如何赋能AI机器人
随着数智浪潮到来,AI 赋能的机器人革命正揭开产业变革帷幕。MLCC 作为核心被动电子元器件,已渗透至现代机器人架构中六大关键模块。不同类型机器人对 MLCC 性能要求不同,微容科技构建差异化产品矩阵,打破日韩技术垄断。
吴恩达:AI 将最先杀死前端
AI 对程序员的影响引发热议,吴恩达在 Newsletter 中给出加速排序:前端 > 后端 > 基础设施 > 科研。他认为前端开发被加速最厉害,后端需更多人工引导,基础设施和科研领域 AI 作用有限。同时指出初级、缺乏协作和创造性的工作易被取代。
第一批买机器人做家务的人崩溃了
第一批买机器人做家务的人崩溃了,自主机器人常闯祸,体验感差。传奇程序员卡马克建议卖远程家政服务,如1X Technologies的NEO机器人就是远程操控。但也有人认为机器人应具自主性,部分企业还搞预售圈钱。