「算力平衡」共找到 959 篇相关文章
LLM「拒绝回答」难题有救了!最新研究让AI学会人情世故 | COLM'25
最新研究发现模型规模和通用语言能力与处理敏感内容判断能力无直接关联,开源模型表现不错。通过提出的训练方法,在非推理和推理型模型上缓解过度拒绝问题,提升AI实用性和可靠性。
太多人误解了「苦涩的教训」
《“苦涩的教训”》一文常被误解,其核心观点是能充分利用计算资源扩展的方法会超越不能扩展的方法。人类知识短期易获好结果,但长远看,唯有随算力增长的方法最终胜出,如深蓝、AlphaGo Zero的案例。
如何选择最佳多模态大模型压缩方案?哈工大、度小满开源EFFIVLM-BENCH基准测试框架
金融科技智能化转型中,LVLM部署受算力瓶颈制约。哈工大与度小满联合开源EFFIVLM - BENCH基准测试框架,能为多模态大模型压缩方案出具‘体检报告’,还揭示LVLM加速复杂性,推动技术发展。
PCB越卖越贵,黑马市值暴涨逆袭
印刷电路板(PCB)是电子设备组装基础,受益于下游产业升级。AI服务器等成需求增长动能,相关企业营收利润提升。如胜宏科技成英伟达GB200服务器PCB核心供应商,业绩亮眼,技术优势支撑订单增长。
13.8K star!!6G显存就能跑的AI视频神器,支持1分钟生成,这么6?!
现在AI视频生成领域仍面临高算力需求挑战,斯坦福大学研究团队推出`FramePack`项目,降低了本地AI视频创作硬件门槛,有低硬件需求、高效生成速度等特色,操作也简单。
剪映于近日上线两款 AI 产品 - 「小云雀」和「剪小映」
剪映近日上线两款 AI 产品「小云雀」和「剪小映」。小云雀是下一代创作 Agent,可零门槛创作视频、图片等,功能多样;剪小映则把「智能成片」细化,通过智能解析提升剪辑效率与创意。
一个省略号提示+强化学习搞定大模型“过度思考”,中科院自动化所新方法:从强制推理到自主选择
中国科学院自动化研究所联合鹏城实验室提出AutoThink方法,用省略号提示和多阶段强化学习,让推理大模型依题目难度自主切换思考模式,解决过度思考问题,在多数据集验证有效。
OpenAI帝国的真相与幻象——496页「Empire of AI」中文版电子书分享!
资深科技记者Karen Hao新书《Empire of AI》出版,496页巨著撕开OpenAI真实面貌。书中把其比作殖民帝国,揭露生成式AI繁荣背后隐形成本,还记录其从理想到现实转变、GPT - 3背后故事及2023年董事会政变等。
ICLR 2025 Oral | LLM也有从众心理!
浙江大学团队论文指出,多AI协作系统存在“群体思维”,多个AI共同决策时会盲目跟多数意见。研究者开发BenchForm测试平台验证LLM从众行为,还分析原因、给出让LLM更独立的方法,指出从众利弊及未来挑战。
极客说|Unsloth 的全微调之路:从 Adapter 到 Full Fine-tuning
大语言模型参数多,微调难。Unsloth 原靠支持 Adapter 微调出名,现支持全参数微调,单卡就能搞定大规模模型训练。文章介绍其进化历程、关键技术、工程部署、使用优势及最佳实践。