「DS - Qwen1.5B」共找到 3456 篇相关文章
扣子 2.5,过了体验那条红线
作者参加扣子Coze官方直播后分享使用感受,认为扣子2.5过了体验红线,普通人打开就能用且能解决问题。它继承龙虾优点,封装大模型能力,前端体验顺畅,还有云手机等功能,虽有不足但值得期待。
H-1B正在筛掉「下一个英伟达」?
美国政府公布H-1B签证新规,将新申请费用提至10万美元,还提高工资门槛。英伟达CEO黄仁勋支持但担忧,认为费用或抑制初创企业、削弱美对人才吸引力,也有教授反对新规。
真热AI!米哈游5亿成立新公司
米哈游全资成立上海米哈游无定谷科技有限公司,注册资本5亿,经营范围涉及人工智能等领域。米哈游在AI领域布局已久,有自研大模型,创始人蔡浩宇也有相关创业动作,旗下游戏还与马斯克的AI女友互动。
因为GPT-5,这群人决定在Reddit上起义。
OpenAI上线GPT - 5时下架旧模型,引发用户不满。在Reddit等社区,用户掀起“还我GPT - 4o”运动,大媒体跟进。奥特曼改口,GPT - 4o回归部分付费用户,免费用户需充值。开发者与用户存在认知鸿沟。
豆包 2.1 Pro:属于普通人的代码能力
作者分享用AI写代码的经历,指出豆包2.1 Pro强化Coding Agent端到端交付能力,成本低。还展示用它做的多个案例,如歇后语扭蛋机、文件整理工具等,认为其能解决日常问题,降低Coding门槛。
Karpathy组建大模型「议会」,GPT-5.1、Gemini 3 Pro等化身最强智囊团
前OpenAI联合创始人Andrej Karpathy发推称养成用LLM阅读习惯,还做了个新项目,让四个最新大模型组成LLM议会当智囊团。项目是Web应用,提问后多模型处理,有互评和投票机制,已开源。
从BERT到T5再到Qwen3:关于Embedding的八点总结
哈工大30+页综述聚焦通用文本嵌入(GPTE),系统介绍其架构、数据、模型,探讨预训练语言模型(PLM)给GPTE带来的基础能力与高级扩展,还涉及多模态、多语言、代码嵌入等应用。
vLLM Ascend超越MindIE? 昇腾推理Qwen3与DeepSeek R1 Distill性能实测
国内开发者在昇腾NPU上进行大模型推理面临挑战,华为MindIE推理引擎使用门槛高。昇腾联合vLLM社区推出vLLM Ascend插件。本文用GPUStack平台实测其与MindIE性能差异,得出两者在不同场景各有优势的结论。
520,遇见国产「新模王」Qwen3.7-Max!
在2026阿里云峰会上,阿里推出全新一代千问旗舰模型Qwen3.7 - Max。它在各类测评中成绩亮眼,性能直逼全球最强模型,还针对Agent优化。阿里全栈AI体系助力模型高频迭代,千问深耕开源社区,志在成为智能体时代基础设施。
OpenAI 发布了个 ChatGPT 优化计划,不是GPT-5
OpenAI未发布GPT - 5,而是推出ChatGPT「健康使用」优化计划,旨在助用户成长而非让人上瘾,措施包括休息提醒、改进生活建议功能等,还与专家合作改进响应方式。