「新模型」共找到 9413 篇相关文章
GPT-5终于来了!在惊喜不多的时代,它是否值得我们的等待?|甲子光年
北京时间8月8日凌晨1点,OpenAI正式发布新模型GPT-5。它是目前最强通用模型,在多方面全面进化,将成ChatGPT默认模型。不过它虽有进步,但未掀起革命,GPT系列或难有飞跃,而OpenAI仍规划了未来发展。
刚刚!Qwen3深夜升级,碾压Kimi K2和DeepSeek V3
通义千问更新旗舰版Qwen3模型,推出Qwen3 - 235B - A22B - Instruct - 2507 - FP8。新模型通用能力显著提升,在多测评中超Kimi - K2等模型,还增强多语言覆盖等性能,已在魔搭和Hugging Face开源。
4秒出百万面!突破千万面精度+12K高清贴图,手握数亿的3D生成公司下一局怎么打?
影眸科技旗下Hyper3D受英伟达青睐。该司完成数亿元融资,发布全新模型Hyper3D Rodin Gen - 2.5,引入类LLM的Thinking机制,4秒生成百万面级模型,还突破千万面精度,搭配12K原生3D贴图模型。
中学生就能看懂:从零开始理解LLM内部原理【十】| “过拟合” 与 Dropout
文章围绕神经网络过拟合问题展开,介绍了过拟合的概念、危害及产生原因,阐述了缓解过拟合的正则化方法,重点介绍了Dropout随机失活,还指出其局限性及在大模型中的应用策略。
720美元套出A社死藏的Opus原始思维链,还是Haiku泄露的,GPT/Gemini也中招
研究人员发现,将大模型返回的加密推理块扔给同厂小模型让其复述,就能破解大模型隐藏的思维链。如Anthropic、OpenAI、Google的模型均中招,还会带来隐私、安全等风险,虽已打补丁,但仍有难题。
Unsloth发布Qwen3-VL本地运行和微调指南,修复隐藏bug
Unsloth团队修复Qwen3-VL系列模型聊天模板语法问题,重新上传GGUF量化文件,使模型可本地稳定运行。介绍了不同规格模型硬件需求、表现,给出部署步骤、参数差异,还展示多模态能力测试,提供多种格式模型及微调工具。
实测爆火的阶跃星辰Step 3,性能SOTA,开源多模态推理之王
在 WAIC 2025 前一天,阶跃星辰推出新一代基座模型 Step 3,它是开源 VLM 新晋之王,性能超同类别开源模型,与顶尖闭源 VLM 也有一战之力。该模型具备多开好省特点,还展示了宏大技术生态与商业化布局。
卡帕西入职Anthropic仅两月疑离职;日媒拆解宇树G1后认输:短期内赶不上中国;腾讯317万年终奖员工被辞退:永不录用|AI周报
这篇 AI 周报涵盖诸多热点,如 AI 大神 Karpathy 入职 Anthropic 两月疑离职;Kimi K3 超越闭源模型引关注,美指控其蒸馏美模型;腾讯员工晒 317 万年终奖被辞退;360 首任董秘追讨股权;多家公司有模型发布、业务调整等动态。
3D-R1重塑三维视觉语言推理!让三维交互更智能
近年来,视觉 - 语言模型在2D图像理解有突破,但3D视觉语言模型面对复杂场景不足。为此上海大学团队提出3D - R1模型,它基于新数据集和策略构建,有强多任务三维理解能力,不过也存在进步空间。
直播实时离线翻译
传统离线翻译模型有延迟问题,GitHub上NoLanguageLeftWaiting开源项目把Meta的NLLB模型改造成实时同传模型,能边听边译,支持200种语言互译,还在开发推测解码功能提升速度。