「V3.1模型」共找到 9172 篇相关文章
拯救P图废柴,阿里上新多模态模型Qwen-VLo!人人免费可玩
昨夜阿里推出全新多模态模型Qwen-VLo,在原有能力上全面升级,有细节捕捉、图像编辑、多语言支持等亮点,不受固定格式限制。官方demo展示多种玩法,目前免费可玩,实测其编辑能力不错。
Cursor 1.0 正式上线,写代码、审代码,一站式全能!多项功能体验升级!
Cursor 1.0正式发布,带来多项重磅升级。有自动代码审查与BugBot、后台智能体全面开放、Jupyter Notebook深度集成等功能,还引入记忆系统,升级一键集成与可视化体验。在对手被封杀背景下这次升级意义重大。
SGLang × RoleBasedGroup(RBG):打通大模型推理PD分离架构规模化落地的“最后一公里”
PD分离架构对大模型推理部署意义重大,SGLang支持该架构且性能佳。但从测试到生产落地难,存在部署、资源、可靠性等问题。SGLang开源RBG项目,结合二者为PD分离架构生产化落地提供方案。
逆天!Mata用13个参数26字节让模型正确率从76%飙升至91%
Meta等机构研究人员发布TinyLoRA极致微调技术,配合强化学习,能在几乎不改变大模型原有结构下,用极少数参数激发其推理能力。该技术在数学推理上表现出色,还探索了参数共享策略和存储精度问题。
所有大模型,都学物理学:北大物理系一篇研究,震撼了AI圈
北大等机构团队跨界用物理学最小作用量原理,提出新颖方法估计 LLM 生成方向性,揭示其背后‘物理定律’。发现 LLM 生成有细致平衡现象,还能用物理指标给大模型画像,让 AI 研究提升到‘物理科学’高度。
d-Matrix用3D堆叠技术终结"内存墙",AI推理迎来光速时代
2025年9月Hot Chips上,d - Matrix展示3D堆叠数字内存计算技术,直击AI“内存墙”难题。其产品Corsair带宽强大,新Pavehawk架构更有性能跃升,为AI推理开辟新赛道,虽面临挑战但前景可期。
网易游戏 Tmax 平台实践:基于 Fluid 的云原生 AI 大模型推理加速架构
网易游戏打造 Tmax AI 机器学习平台,但大模型推理业务规模爆发带来资源弹性等挑战。经评估,选用 Fluid + AlluxioRuntime 构建三层架构,有自动预热等配置,带来性能、成本等多方面收益。
腾讯混元团队最新研究:让 AI 从「固定模型」走向「实时适配系统」
腾讯混元团队提出论文《HY-WU (Part I)》,尝试让模型在推理阶段根据输入实时动态生成适合任务的参数,而非依赖固定参数。通过多类实验验证,这种方式在图像编辑等任务中有明显优势,还降低了训练复杂度。
前Meta工程师爆料:17人团队15个H-1B!一夜之间80%对手没了?
美国政府将H - 1B申请费用门槛提至10万美元,引发各方讨论。黄仁勋、奥特曼等支持,也有人认为会打击美国创业企业。此新规或重塑全球人才格局,让其他地区有机会吸纳人才。
百年黎曼猜想被Claude破了新纪录!是个未公开新模型
A社官宣未公开的Claude研究模型在黎曼猜想取得重大进展,将满足猜想的黎曼ζ函数零点比例下界从41.6%提高到67.2%。它靠60个智能体、3100万输出Token完成研究,几乎走完科研流程。