低秩参数修剪」共找到 1602 篇相关文章

产品应用8

比10年专业医生准4倍!微软发布突破性医疗AI系统

微软首席执行官分享新发布的医疗AI系统MAI - DxO,它模型无关,能适配不同语言模型,模拟医生诊断流程。测试显示其准确率远超专业医生,成本大幅下降。此外还发布序贯诊断基准SDBench。

AIGC开放社区
新闻资讯8

SGLang 推理引擎的技术要点与部署实践|AICon 北京站前瞻

SGLang 是开源推理引擎,截至 2025 年 6 月,GitHub 近 15K Stars,月均下载量超 10 万次,被多个行业巨头采纳。InfoQ 专访其核心开发者尹良升,他分享关键技术等内容,6 月 27 - 28 日他将在 AICon 演讲。

InfoQ
开源动态8

没想到,最Open的开源新模型,来自小红书

向来调的小红书昨日开源首个自研大模型 dots.llm1,它是中等规模的 MoE 模型,在较小激活量下性能良好。其开源力度堪称行业最大,还介绍了数据处理、训练优化等多方面技术细节。

机器之心
新闻资讯7

苹果拆解AI大脑,推理模型全是「装」的?Bengio兄弟合著

苹果最新研究揭示大推理模型(LRM)在高复杂度任务中普遍‘推理崩溃’。即便给予明确算法提示,模型亦无法稳定执行,暴露推理机制的局限性。研究还通过多种实验环境分析了模型在不同复杂度问题中的表现。

新智元
推荐文章7

618想换电脑跑AI?先听我一句劝。

文章围绕618换电脑跑AI展开,分析了本地跑AI的情况,包括不同模型对算力和显存的要求,指出本地跑的好处是隐私安全、无限免费,还推荐了不同预算的笔记本,为想换电脑学AI的人提供参考。

数字生命卡兹克
算法论文8

全球顶尖AI做物理,被人类按地摩擦?不懂推理大翻车,本科生碾压

港大等机构用3000道物理题测试顶尖大模型,如GPT - 4o、Claude 3.7 Sonnet等,结果模型准确率远于人类专家。研究推出PHYX基准测试,揭示模型依赖知识、公式和模式匹配,缺乏真正物理理解。

新智元
新闻资讯7

大厂程序员:AI正在将我们变成高速流水线工人,受不了了

亚马逊鼓励程序员用AI,结果成变相强迫,人员减半、项目提前,程序员只能让AI写代码,但AI编程正确率,让工作更繁杂,职业晋升也成问题。亚马逊官方称AI能提效,双方看法不一。

量子位
新闻资讯7

OnlyFans和AI女友,谁会是最后的赢家?

OnlyFans以80亿美元估值寻求出售,此时AI女友市场正疯狂扩张。OnlyFans有真实性、商业生态等底牌,AI女友有成本和个性化优势。二者各有软肋,未来或市场分化,技术进步或使天平向AI倾斜。

AGI Hunt
算法论文8

ParScale:一种全新的大模型Scaling Law

文章提出并行扩展(ParScale)路线,在不增模型参数下,通过引入并行流提升性能。新扩展定律打破传统范式,两阶段后训练策略降成本,还适用于边缘设备,研究仍在进行。

通义千问Qwen
开源动态8

完全开源的7B模型,性能比肩主流LLM,训练成本仅16万美元,复现DeepSeek的强化学习!

Moxin-7B由多机构团队联合开发,遵循“开源科学”原则,公开全流程细节。它训练成本仅16万美元,评测表现亮眼,在架构、数据策略、训练过程等方面有创新,为中小企业提供可控AI方案。

AI科技大本营