「自适应语言模型」共找到 8056 篇相关文章
LLM加速利器LMCache,极大降低GPU资源消耗
LMCache是大语言模型服务引擎扩展组件,能降低首次响应延迟、提升吞吐量,适用于长上下文场景。它将KV缓存存于多级存储,跨服务实例复用任意重复文本的KV缓存,节省GPU算力,与vLLM结合优化显著。
炮轰黄仁勋,决裂奥特曼!1700亿美元估值背后,硅谷最不好惹的AI狂人
本文介绍AI圈大佬Dario Amodei,因家庭变故投身AI。他带领Anthropic发展迅速,拟融资使估值达1700亿美元。不过公司亏损严重,且面临开源模型竞争。他坚信AI发展快,要加速开发并注重安全。
AST | 西交大刘子扬、陈刚等:直接嵌入流场特征的智能化气动外形优化经验学习框架
传统气动外形优化方法有局限,本文提出智能化优化经验学习框架,结合DNN流场预测模型与DRL优化方法,还提出自适应网格再生成技术与Sigmoid奖赏函数,经验证效果良好,为气动优化提供新路径。
Qwen3.8-Max:编程与办公,全面跃升
今日正式发布Qwen3.8-Max,下周将开源其及Qwen3.8 - 27B模型权重。它参数达2.4万亿,在多方面全面提升。开发者可通过千问AI平台获API服务,性价比高。在编程、办公等场景表现出色,用户反馈良好。
黄仁勋人生第一推,把硅谷劈成了两半!
7月24日晚,黄仁勋在X首发帖,公布25家联署的‘开源为什么重要’公开信,引发关注。马斯克、奥特曼等表态支持,但OpenAI等闭源三巨头缺席。信中为‘蒸馏’正名,凸显‘扩散派’与‘稀缺派’矛盾,中国开源模型崭露头角。
太抓马了!马斯克OpenAI开庭,硅谷巨富互揭老底像极了村口吵架
马斯克与OpenAI的世纪庭审爆点不断。马斯克承认xAI用OpenAI模型训练Grok,且庭审中六次失态;OpenAI也有黑料,如Brockman日记暴露其私下盘算。目前风向对马斯克不利,后续还有奥特曼等证人登场。
给 Happy Horse-1.0 讲完戏,我无痛当上导演了
文章聚焦阿里新发布的视频模型Happy Horse-1.0,经测试它在多镜头一致性、人物表现力和视频编辑功能上表现出色,能产出电影质感画面,且价格有竞争力,但物理拟真短板明显,已具影视工业应用潜力。
比0.99元羊毛更重要的,是跟AI砍价的快乐
双11期间,不少人分享跟Kimi Agent会员砍价战果,原本49元/月的会员能砍到0.99元。作者尝试多种砍价话术,如夸夸、卖惨等,还对比其他模型,最后总结出砍价秘诀,活动有时间和新老用户限制。
让LLM不再话痨,快手HiPO框架来了
当前LLM存在‘过度思考’困境,效率与成本矛盾突出。快手与南大合作推出HiPO框架,通过混合数据冷启动和混合强化学习奖励系统,让模型能自主决策思考模式,实验显示它提升了效率和准确率,还具强泛化性。
NVIDIA技术沙龙 《大规模EP优化:PD分离MoE并行方式》课程笔记
本文是NVIDIA技术沙龙课程笔记,介绍大规模EP优化的PD分离MoE并行方式。涵盖PD分离、大规模专家并行等五项关键技术创新,还对比多模型架构,展示推理服务架构性能特点与优化策略,以及各技术工作流程和效果。