「DeepSeek 1.5B」共找到 4011 篇相关文章
GPT-5.2发布,真正的牛马打工人专属AI来了。
OpenAI十周年凌晨2点发布GPT - 5.2。它在部分跑分上提升不大,但在ARC - AGI - 2和GDPval评测集表现亮眼,上下文处理能力也大幅加强。将开放给会员使用,价格比5.1贵。
国内首次!8.9毫秒推理速度破纪录,1元打穿百万token
在2025人工智能计算大会上,浪潮信息发布元脑SD200和元脑HC1000两款AI服务器。前者让DeepSeek R1的Token生成速度达8.9毫秒,后者将推理成本降至1元/百万Token,解决了AI智能体速度与成本难题。
陶哲轩用GPT-5解决数学难题:仅29行Python代码
陶哲轩最新发帖称,GPT - 5帮他解决MathOverflow上的问题,证明序列lcm(1,2,…,n)并非高度丰数的子集。他与GPT - 5沟通生成参数,并用其生成的29行Python脚本验证,且未遇AI幻觉问题。这不是他首次用AI解题。
The Batch: 930 | DeepSeek 放弃 Nvidia 转向华为
中国开源权重模型开发者 DeepSeek 在 DeepSeek-V4 最新更新中未给美国芯片厂商适配机会,却向华为提供预发布版。美国限制出口芯片反促中国发展本土芯片,该决定加深中美 AI 生态分裂。
刚刚,阿里Qwen3.6又悄悄放出4个开源权重,卷疯了
继今年2月发布Qwen3.5系列后,阿里推出Qwen3.6多个开源权重版本。Qwen3.6优先保障稳定性与真实场景可用性,为开发者提供更好编码体验。介绍了Qwen3.6 - 27B和Qwen3.6 - 35B - A3B亮点。
刚刚,OpenAI 再次开源!安全分类模型 gpt-oss-safeguard 准确率超越 GPT-5
OpenAI 开源安全分类推理模型 gpt-oss-safeguard,有 120b 和 20b 参数量版本,采用 Apache 2.0 许可证。它能直接理解策略文档分类内容,推理能力超 GPT - 5,性价比高,虽有局限但仍是开发者利器。
DeepSeek大招曝光?梁文峰督战超级智能体:能自主学习,或年底发布
据彭博社爆料,DeepSeek正开发AI智能体,打造无需复杂指令、可自主学习与执行的下一代AI系统,年底发布。此前DeepSeek R1表现出色,曾推动开源发展,此次新动作彰显竞争决心。
我用 GLM-5.2 读 148 万字资料:一天读懂一个知识
作者用 GLM-5.2 处理 148 万字 Transformer 资料,它生成可打开的 HTML 阅读页,将内容排成理解路线。GLM-5.2 在评测榜单中进入第一梯队,主打 1M 上下文,还分享了使用该模型处理资料的具体做法。
5款大模型考「山东卷」,Gemini、豆包分别获文理第一名
近日,字节跳动Seed团队用2025年山东高考真题对5款大模型进行全科闭卷测评。结果显示,豆包Seed1.6 - Thinking获文科第一,Gemini 2.5 Pro获理科第一。大模型一年间进步显著,未来或融入更多领域。
新“SOTA”推理模型避战Qwen和R1?欧版OpenAI被喷麻了
“欧洲的OpenAI”Mistral AI发布首款推理模型Magistral,却再遭质疑未与最新版Qwen和DeepSeek R1对比。该模型亮点是支持多语言推理,以纯RL方式训练,为LLM强化学习提供新范式。