「GPT4.1」共找到 3430 篇相关文章
DeepSeek R1 迎来小更新大升级,性能直逼 OpenAI o3!
昨日,DeepSeek 发布 R1 大模型最新版本 DeepSeek - R1 - 0528 并开启公测。虽官方未附详细技术说明,但用户反馈推理和输出有改进,也有性能方面的不同看法,其在基准测试表现佳。
马斯克终于成『AI No.1』,6大案例看实力与水分
马斯克发布Grok 4,宣称其超越OpenAI等LLM。它屠了各种榜单,但Grok系列口碑欠佳。文中通过多案例测试,展现其在各方面的表现,如编码、数学、图像等,还提到了API速度和价格。
GPT-5数字母依然翻车!马库斯:泛化问题仍未解决,Scaling无法实现AGI
杜克大学教授让GPT - 5数blueberry里的b,结果GPT - 5多次答错。著名学者马库斯整理其各种bug,指出大模型泛化问题严重,认为Scaling无法实现AGI,转向神经符号AI才是途径。
OpenAI主攻速度的第一个模型来了:GPT‑5.3‑Codex‑Spark
OpenAI发布GPT-5.3-Codex-Spark,是GPT-5.3-Codex轻量级版本,也是首个为实时编程设计的模型。亮点是速度快,推理超每秒1000 token,已向ChatGPT Pro用户开放,后续规划融合两种工作模式。
奥特曼首晒GPT-5实测!被曝使用超级对齐团队“遗产”
奥特曼首晒GPT - 5实测,虽对话仅围绕电视剧推荐,但引发大量关注。除官方放料,还被曝重写编码规则,用上超级对齐团队“遗产”通用验证器,不过也有爆料称其研发遇困难。
从Transformer到GPT-5,听听OpenAI科学家 Lukasz 的“大模型第一性思考”
2017年《Attention Is All You Need》提出Transformer架构,重塑AI版图。其作者“Transformer八子”中,Lukasz Kaiser加入OpenAI,参与GPT-4、GPT-5等研发。他10月将出席大会分享见解,曾预言多模态等趋势已渐成现实。
GPT-5「降智」真相曝光:不是变笨,而是五个超级开关没激活
新智元报道,OpenAI最新提示工程指南揭秘调教GPT - 5的方法。通过调整自主探索倾向、推理深度等五个开关,可让GPT - 5从偶尔靠谱变全能,还介绍了元提示小技巧解锁其潜力。
致敬Kimi K2:基于slime的全流程INT4量化感知RL训练
受Kimi K2团队启发,SGLang RL团队落地INT4量化感知训练流程方案,在强化学习多方面取得进展,还在slime框架复现全流程方案,实现媲美BF16精度,提高Rollout效率,为社区提供开源参考。
新“SOTA”推理模型避战Qwen和R1?欧版OpenAI被喷麻了
“欧洲的OpenAI”Mistral AI发布首款推理模型Magistral,却再遭质疑未与最新版Qwen和DeepSeek R1对比。该模型亮点是支持多语言推理,以纯RL方式训练,为LLM强化学习提供新范式。
面壁MiniCPM4推理速度3倍,碾压同尺寸Qwen3,阿里上眼药了~
面壁发布包含10个模型的MiniCPM4系列,其推理速度快。它有高效模型架构、学习算法、高质量训练数据和推理系统等创新点,还给出了MiniCPM4实战代码及启用InfLLM v2的参数设置。