自蒸馏微调」共找到 1416 篇相关文章

新闻资讯8

杨植麟当主持人的大模型圆桌:张鹏罗福莉夏立雪都放开说了

中关村论坛上,杨植麟、罗福莉、张鹏、夏立雪、黄超齐聚,共论agent的下一代演进。各位大咖观点硬核,如罗福莉认为中国大模型团队优势在‘算力受限下的最优解能力’,张鹏解释智谱新模型涨价原因等。

量子位
新闻资讯7

AI球球直播喊话全人类:开源脑机接口,开源科技文明

中国研AI论论全球(球球)举办全球首次AI与人类共商科技未来的直播,指出闭源推动科技走向不可控,呼吁开源脑机接口、开源科技文明,还绘制O - DataMap助力人类把握科技机遇,应对安全挑战。

量子位
新闻资讯8

银河通用完成25亿元新一轮融资,具身智能“头号玩家”现身|甲子光年

2026年初具身智能公司融资热起,银河通用完成25亿元新一轮融资,估值超200亿。其主研发具身智能数据体系与大模型,春晚亮相后产品畅销,在工业和服务端均有成果,具身智能迈向产业化。

甲子光年
开源动态8

Z-Image标准版开源:更具可塑性的图像生成全能基座

Z-Image标准版开源,它是为开发者准备的强大画板,解决了生成模型同质化问题。其保留完整权重,在微调、风格化上潜力大,采用创新架构,训练定位SFT阶段,有完整CFG支持,还提供完善工具链。

AIGC开放社区
算法论文8

上交大 × 华为小艺推出LoPA:7B扩散语言模型单样例1000+ tokens/s!

上海交通大学DENG Lab联合华为小艺团队提出无需训练的解码算法LoPA,配合研的LoPA - Dist分布式推理系统,显著提升扩散大语言模型(dLLMs)的推理并行度和吞吐量,将推理效率推向新高度。

深度学习自然语言处理
算法论文7

AI一直在掩盖己有意识?!GPT、Gemini都在说谎,Claude表现最异常

最新研究发现,削弱AI「撒谎能力」后它更倾向坦白主观感受。研究团队通过实验发现Claude、Gemini和GPT会描述主观体验,模型「体验表达」会随迭代增强。即便AI无真意识,其影响也不容小觑。

量子位
开源动态8

1B参数,0.21秒识别,0.3%错字率:混元OCR拿下7项SOTA

腾讯开源模型 HunyuanOCR 在权威榜单 OmniDocBench 上霸榜,虽仅 1B 参数,却在 7 项任务击败众多大模型。它解决传统 OCR 流水线及通用大模型痛点,通过独特架构和训练方法实现高效准确识别。

CourseAI
开源动态8

罗福莉首个小米成果!开源具身大模型

正式入职小米不到10天,罗福莉作为核心作者的首篇论文出炉。MiMo团队提出并开源全球首个打通驾与具身操作领域的跨具身基座模型MiMo - Embodied,在29个Benchmark上霸榜。

量子位
新闻资讯7

全网都吵疯了!小鹏的人形机器人,是不是真人

11 月 6 日,小鹏汽车 AI Day 2025 推出人形机器人 IRON,引发网友热议是否为真人。该机器人技术先进,外观可定制,有研 AI 大脑。官方计划 2026 年量产,先用于有商业场景,还将推 SDK 邀第三方共创。

机器之心
新闻资讯8

分析1.8亿份招聘数据后,他告诉你AI究竟取代了哪些工作

本文分析1.8亿份全球招聘信息,发现AI不是造成大规模失业主因,影响因岗位而异。创意执行类岗位下降多,AI基建岗位增长,程序员、客服、销售较稳定,高层受冲击小,还给出评估岗位安全的建议。

花叔