「2Bit量化」共找到 2093 篇相关文章
奥特曼深夜官宣:OpenAI重回开源!两大推理模型追平o4-mini,号称世界最强
OpenAI深夜推出gpt-oss 20B和120B两款开源模型,性能比肩o3-mini和o4-mini,能在消费级显卡甚至手机运行。有宽松许可证等亮点,还准备了体验网站。这是自GPT - 2后首次开源,降低了部分群体准入门槛。
LLM+RL遭严重质疑,随机/错误等虚假奖励也能提升至标准效果?
论文在AI领域观察到类似随机给糖或奖励错误答案让孩子成绩提升的现象,‘虚假奖励四大奇招’效果接近用标准答案训练,Qwen2.5 - Math - 7B模型在测试集上性能飙升,还揭示了Qwen特别的原因及随机奖励有效的推手。
AutoResearch实战:让AI自己训YOLO,mAP从0.729到0.773
本文作者复盘用AutoResearch训练YOLOv8模型全过程。先介绍其要素框架,选YOLOv8 + NEU - DET做实验,经V1轻量验证后升级到V2完整闭环,64轮实验后mAP从0.729提至0.773,还总结工程结论并给出迁移场景建议。
Anthropic刚发布了一份「AI抢饭碗报告」:学历越高越「被抢」
Anthropic《经济指数报告》揭示,任务越复杂AI加速越猛,学历高的工作受影响大。还指出人机协作能大幅提升任务时长,不同国家AI应用有贫富和技术代差,也提到了‘去技能化’问题及对生产率的预测。
陶哲轩用GPT-5解决数学难题:仅29行Python代码
陶哲轩最新发帖称,GPT - 5帮他解决MathOverflow上的问题,证明序列lcm(1,2,…,n)并非高度丰数的子集。他与GPT - 5沟通生成参数,并用其生成的29行Python脚本验证,且未遇AI幻觉问题。这不是他首次用AI解题。
扒开源码:那个宣称“每半小时疯抢1万个注册码”的AI项目,到底在割谁?
近期技术群流传 UUMit 平台链接,宣称是“能让 AI 智能体自己接单打工赚钱的 A2A 平台”,极为火爆。但作者查看源码发现,该平台是前端单机戏法、点击劫持的广告套利站。文中还介绍了 AI 概念下五种套利黑产及识别方法。
6.1B激活,三榜开源第一!蚂蚁·安诊儿医疗大模型发布
由浙江省卫生健康信息中心等联合研发的开源医疗语言模型AntAngelMed发布。它基于Ling - flash - 2.0,100B总参数仅激活6.1B达约40B密集模型性能,在多个权威医疗基准测评中居前列,采用三阶段训练流程,高效MoE架构。
GPU-MODE Leaderboards之vector_add histogram 以及一些有趣发现
文章介绍GPU-MODE Leaderboards中vector_add和histogram任务。分析vector_add实现、带宽利用率,rank1代码用cccl,带宽利用率超80%;histogram算子瓶颈在atomic冲突等,rank1也多用cccl,还给出rank2代码,最后提及任务中Hack行为及代码提交方式。
为什么说多模态是推荐系统破局的关键?来自饿了么一线的实战复盘
文章围绕多模态推荐展开,从传统推荐算法演进到多模态表征技术,结合饿了么场景实践,还探索生成式推荐。介绍多模态推荐挑战与代表性工作,梳理表征技术发展,详述饿了么系统设计与训练,分析生成式推荐方案及业界路线。
回归C++: 在GGUF上构建高效的向量模型
Jina AI分享将纯解码器向量模型适配到GGUF格式及在llama.cpp工具链的优化经验。经处理得到特定任务v4模型,还生成量化版本并上传。介绍使用方法、注意事项,经测试推荐IQ3_S或IQ3_M版配合定制工具。