大模型发布潮」共找到 10153 篇相关文章

算法论文8

华为中科联创模型低比特量化算法,1‰数据实现昇腾无损压缩7倍

华为诺亚方舟实验室联合中科提出CBQ后训练量化方案,仅用0.1%训练数据实现模型7倍压缩,保留99%精度。该成果登ICLR 2025 Spotlight,已加入昇腾ModelSlim工具包。

新智元
开源动态8

以小博!Nanbeige4-3B重磅开源:硬刚Qwen3,挑战小模型能力新高度

近年来语言模型参数膨胀,成本升高,业界重注小语言模型。近日,Boss直聘南北阁模型实验室发布仅30亿参数的Nanbeige4 - 3B,在多方面媲美甚至超越通义千问Qwen3系列模型,开源印证小模型潜力。

AIGC开放社区
算法论文8

NUS、牛津等联合发布音视频智能综述:系统梳理模型时代的AVI全景图

NUS领衔近10家机构发布音视频智能综述,系统梳理模型时代AVI发展全貌,涵盖感知、生成与交互,复盘子方向工作,构建任务蓝图,整理评测体系,总结基础技术,还探讨应用、安全及未来研究方向。

新智元
开源动态8

小红书发布FireRedChat:首个可私有化部署的全双工模型语音交互系统

小红书智创音频团队推出业内首个支持私有化部署的全双工模型语音交互系统FireRedChat,可将半双工链路升级为全双工,提供级联与半级联服务,在多指标领先,让AI有“人感”。

机器之心
产品应用8

英伟达帮你省钱,让模型推理「短而精」,速度快5倍

过去模型推理追求长链思维,导致推理链长、Token消耗、响应慢。英伟达研究院的DLER研究给出解决办法,通过强化学习优化方法让模型‘短而精’,推理长度减超70%且准确率不变,还适用于模型

机器之心
算法论文8

2026开年关键词:Self-Distillation,模型真正走向「持续学习」

2026年刚开场,Self - Distillation成模型领域高频词汇。传统强教师依赖范式难适配模型持续进化,MIT等顶尖机构发布三项成果,用不同方法实现自蒸馏,推动模型持续学习。

机器之心
新闻资讯7

独家|RoboScience 机器科学完成10亿元融资,资金将用于强化 VLOA 模型与本体

AI科技评论独家消息,RoboScience机器科学近日完成10亿元A轮融资,将深化VLOA模型技术,推进自研机器人本体工程化与量产。其VLOA模型有创新性架构,能实现通用泛化,还将发布自研机器人本体。

AI科技评论
开源动态7

国内首套:港中文团队发布7模态人体动作数据集,揭开模型理解能力短板

港中文邢国良教授团队博士生蒋思阳完成 CUHK-X 多模态人体动作数据集,成果被 ACM MobiSys 2026 接收。用其测试主流模型,发现理解人类动作平均正确率仅四成。该数据集数据收集方法反常规,还开展了基准测试。

DeepTech深科技
新闻资讯7

模型能复刻这些系统吗?ProgramBench给出了残酷答案

斯坦福NLP组发布ProgramBench,用200个完整代码库重建任务测试主流模型,要求模型仅根据可执行文件还原如SQLite等项目完整代码,结果所有模型实际解决率为0%,说明模型更擅模仿代码表面结构。

AI工程化
推荐文章7

数据到好猜想:如何用模型做市场研究?

文章指出模型重塑用户需求调研,并非按常规用AI获取和清洗数据,而是让模型扮演真实用户。以品牌分析社交媒体数据为例,探讨数据局限,还介绍‘好猜想’标准,最后说明Atypica.AI能构建消费者智能体解决归纳问题。

Founder Park