「低成本训练」共找到 3884 篇相关文章
“这个怎么组装?”一句无害的问题,如何让AI产生危险输出
Amazon团队发现全新威胁模型“视觉排他性”,提出MM - Plan框架,通过强化学习训练智能体自动发现攻击策略。实验显示其对Claude 4.5 Sonnet和GPT - 5攻击成功率可观,代码和数据集已开源。
DeepMind 创始人 Hassabis 语出惊人:百万 token 只是在贴胶带,AGI 在 2030 年
DeepMind创始人Hassabis在访谈中评估AGI进展,认为当前范式是最终架构一部分,但持续学习等问题待解决,预计2030年左右实现AGI,还探讨了Agent、蒸馏等多方面内容,并给创业者建议。
脸谱心智陆弘远团队ACL 2026新作:别再给模型叠加「高级词」了!模型更爱听「大白话」
脸谱心智与香港中文大学科研人员中稿 ACL 2026 的新工作提出 Adam’s Law,即文本频率定律,揭示文本频率对模型训练及推理的重要性,还给出工程解法,实验效果显著,为行业带来新思路。
重构线性视觉Transformer,精度与效率双平衡 | CVPR'25
南洋理工、北航与合工大联合提出CARE Transformer,以非对称解耦建模局部与全局,降低计算开销、提升特征表达。实验显示其在移动端低延迟高精度,打破“效率与精度不可兼得”困局。
Claude Opus 4.6差评如潮!思考深度暴跌67%,AMD总监6852次日志打脸
Claude Opus 4.6遭差评,用户感其「变笨」,输出浅、易失败、违规提示增多。AMD总监用6852次日志证明其「思考深度」降67%,价格高却性能倒退。Anthropic虽称优化,但用户不满默认值被改。
ESLint v10 发布,但有开发者已经在考虑换 Biome 了
广泛使用的代码检查工具 ESLint 发布 v10 版本,完成架构调整,移除旧版配置系统,改进查找配置文件方式等。但生态兼容性有问题,迁移成本高,部分开发者考虑换用 Biome 等替代工具。
逼AI当山顶洞人!Claude防话痨插件爆火,网友:受够了AI废话
一个叫「caveman」的Claude Code插件在Hacker News爆火,冲破2w星。它核心是条prompt,删掉冠词等废话,号称省75%输出token。但它不压缩模型后台推理token,真实成本节省存疑。
硅谷亲手砸掉自己饭碗?930万岗位正进入AI风险区
Tufts大学发布全美首个「AI就业风险指数」,显示未来2 - 5年,美国约930万个岗位面临被AI替代风险,硅谷等科技重镇首当其冲。高技能、知识密集型职业风险高,而低薪职业相对安全。
马斯克要自己做「英伟达+台积电」!宇宙芯片宏图开工,算力产能扩5000%
马斯克宣布启动史上最大规模芯片计划Terafab,目标是每年生产超1太瓦算力,80%部署至太空。该计划将芯片设计到制造整合,为机器人、AI和太空数据中心造芯片,不过暂无具体时间线。
逐项解读黄仁勋GTC演讲:Vera Rubin、token王、英伟达“龙虾”、太空计算和雪宝|甲子光年
美国当地时间3月16日,英伟达创始人黄仁勋在GTC 2026演讲,发布五项重要技术,包括下一代AI计算平台Vera Rubin等。他想让英伟达成AI基础设施公司,强调token成本,认为AI工厂是工业基础设施。