通用大模型」共找到 9351 篇相关文章

产品应用7

AIGCode宿文:我就是要自训练模型,直接做「L5」| AI产品十人谈

AIGCode宿文坚信Coding是培育模型的最佳场景,公司自训练66B基础模型,发布锡月模型,开启AutoCoder内测。宿文认为AI Coding能解决代码供给问题,目标是实现AGI,虽面临诸多质疑,但他坚持直接做L5。

AI科技评论
新闻资讯8

9位顶级研究员连讲3晚,华为盘古模型底层研究揭秘

华为诺亚方舟实验室成果颇丰,4月开发千亿级通用语言模型Pangu Ultra,5月推出稀疏语言模型Pangu Ultra MoE。5月28 - 30日,机器之心联合举办分享会,9位研究员揭秘量化、剪枝等关键技术突破。

机器之心
开源动态8

全能高手&科学明星,上海AI实验室开源发布『书生』科学多模态模型Intern-S1 | WAIC 2025

7月26日,上海AI实验室在WAIC 2025上发布并开源『书生』科学多模态模型Intern-S1。它首创‘跨模态科学解析引擎’,在多学科专业任务上超越顶尖闭源模型,多模态综合能力领先主流开源模型

OpenMMLab
算法论文8

团队提出 SHINE:将任意文本转化为模型 LoRA,仅需一次前向传播!

团队提出全新超网络架构 SHINE,仅需一次前向传播就能将任意文本转化为模型 LoRA 参数,支持多轮对话。该方法实用潜力、架构创新高效,训练流程成熟,推理快速,为模型持续学习提供新思路。

机器之心
产品应用8

豆包模型 Seed 2.0,有点不一样

模型升级频繁令人审美疲劳,但豆包模型Seed 2.0不同,其核心是Skills调用能力。作者测试了它做的小红书长图文排版生成器和古文翻译器,还体验了APP“专家模式”,展现多模态理解优势。

刘言飞语
算法论文8

景不动人动,MLLM如何面对「移步换景」的真实世界?OST-Bench揭示多模态模型在线时空理解短板

上海多所高校研究者提出 OST - Bench,从智能体探索场景动态在线视角挑战模型能力。它更贴近真实世界,揭示主流多模态模型在线时空理解短板,为未来模型发展指明方向。

机器之心
7

模型如何赋能 Web 渗透测试?

文章指出传统Web安全检测有局限,而语言模型(LLM)可提升漏洞发现覆盖率与准确性。以mcp server为基础介绍自动化漏洞检测方案,还分享实践操作、遇到的问题及解决办法,分析其优缺点并给出拓展思路。

阿里云开发者
开源动态8

6.1B打平40B Dense模型,蚂蚁开源最新MoE模型Ling-flash-2.0

蚂蚁百灵模型团队开源 MoE 模型 Ling-flash-2.0,其以轻量级配置展现卓越性能,在推理速度、任务性能、部署成本间找到新平衡,为模型‘参数膨胀’提供新路径,还在多领域应用表现出色。

机器之心
新闻资讯8

模型第一股”打响上市前哨战!智谱GLM-4.7 刷新开源编程SOTA,修复代码、终端操作表现超Claude 4.5

冲刺模型第一股的智谱推出开源模型GLM - 4.7,主打编程与代理式任务提升。它在多项基准测试中表现出色,UI质量飞跃,还采用新推理机制。智谱上市在即,但亏损扩张快,研发投入

AI前线
开源动态8

模型结构化推理优势难复制到垂直领域!最新法律AI评估标准来了,抱抱脸评测集趋势第一

多个机构研究人员联合发布全新多语言法律推理基准数据集LEXam,它含4886道题,每道长篇题有答案和推理路径。研究显示现有模型应对法律推理难,LEXam引入评估新模式,还对不同模型做了测试。

量子位