大模型公司」共找到 10029 篇相关文章

新闻资讯8

范式跃迁:LLM + EC重构算法设计范式,华为&港城夺冠CVRP国际顶级赛事

近日,华为与港城联合团队‘OptVerse - CityU’在CVRPLib BKS全球挑战赛夺冠。他们用‘模型(LLM)+进化计算(EC)’架构,刷新98个历史最优解,51个设新纪录,验证AI在算法设计潜能。

机器之心
开源动态8

国产AI视频炸了!SkyReels-V3三功能重磅开源,1张图生成逼真视频

昆仑天工SkyworkAI团队开源多模态视频生成模型SkyReels-V3,它能在一个架构内搞定参考图像转视频、视频延长、音频驱动虚拟形象三核心能力,超越主流商业模型,且真正开源。

新智元
算法论文8

治好多模态近视和走神!上海学去偏干预显著提升模型性能

多模态模型存在“近视”和“走神”问题,总是过度关注图像底部而忽略核心内容。上海学与南开学研究团队用两条数学公式去偏干预,无需增加计算成本,却能显著提升主流模型视觉理解能力。

AIGC开放社区
新闻资讯8

新天终启,万象智生!从AlphaGo到GPT-5,新智元十年见证ASI创世纪

2025年AI迈向ASI,新智元迎十周年,9月7日将在北京举办峰会。众多咖齐聚,探讨芯片、模型等前沿突破。今年模型发布密集,如OpenAI、谷歌等有新成果,中国造模型也表现出色,未来智能体等将爆发。

新智元
新闻资讯8

中国团队首次在Nature子刊发布医疗AI标准,未来医生MedGPT摘得全球桂冠

中国AI医疗公司“未来医生”协同专家制定CSEDB,首次提出评估医疗模型临床能力的系统性框架,被《npj Digital Medicine》收录。在其评估下,未来医生的MedGPT在主流模型中夺冠。

量子位
算法论文8

dLLM的「Free Lunch」!浙&蚂蚁利用中间结果显著提升扩散语言模型

近年来,扩散语言模型(dLLM)成为文本生成新势力,生成效率高。但现有解码策略忽视中间迭代信息,研究团队观察到「先对后错」现象,提出 TCV 和 TCR 方法,显著提升模型在推理任务表现。

机器之心
产品应用7

企业软件底层逻辑脱胎换骨:从席位订阅到决策订阅,下一个万亿公司属于这类玩家

模型落地进入深水区,企业级软件底层逻辑发生“脱胎换骨”变化。以特赞提出的GEA架构为例,企业软件竞争从模型能力转向认知结构,价值结构、引力中心等都在改变,软件订阅也从席位转向决策。

量子位
开源动态8

Nanbeige4.2-3B:探索通用Agent小模型

模型越做越的当下,推理成本成了影响Agent规模使用的关键因素。南北阁实验室推出Nanbeige4.2 - 3B,在架构、数据构造和训练pipeline层面做了系统工作,评测表现良好,还探索本地个人助手等应用。

AIGC开放社区
推荐文章7

对话灵感实验室:全帧率 VLM、低成本与分层部署,业务现场不止需要炫技模型

InfoQ对话格灵深瞳灵感实验室,探讨多模态模型下视频理解问题。指出传统视频模型抽帧处理浪费算力和信息,介绍LLaVA - OneVision - 2.0突破长视频理解瓶颈,还提及“视觉智能工坊”助力业务落地。

InfoQ
算法论文8

从少样本到千样本!MachineLearningLM给模型上下文学习装上「机器学习引擎」

新研究 MachineLearningLM 提出轻量可移植「继续预训练」框架,突破 LLM 在上下文学习局限,能学上千示例,在多领域分类任务超基准模型。它有三项核心创新,效果惊艳且应用潜力,还指明未来研究方向。

机器之心