大模型数据」共找到 9982 篇相关文章

新闻资讯8

双重突破:全球首个零售VLA模型来了!开源OpenWBT让机器人遥操门槛暴降!

2025北京智源会上,银河通用机器人展示端到端具身模型GroceryVLA,可在商超场景自主操作,具强适用性等五能力。还发布OpenWBT开源系统,降人形机器人遥操门槛,促产业发展。

量子位
开源动态8

1M 参数干翻 200M!时序预测选模型,你可能一直都选错了

近期时序预测领域新模型频出,作者开源的 QuitoBench 显示,参数量仅 1M 的 CrossFormer 击败模型夺冠。它还揭示模型选择与历史数据长度有关,且数据边际收益高于参数。

AINLPer
算法论文8

团队提出 SHINE:将任意文本转化为模型 LoRA,仅需一次前向传播!

团队提出全新超网络架构 SHINE,仅需一次前向传播就能将任意文本转化为模型 LoRA 参数,支持多轮对话。该方法实用潜力、架构创新高效,训练流程成熟,推理快速,为模型持续学习提供新思路。

机器之心
产品应用8

豆包模型 Seed 2.0,有点不一样

模型升级频繁令人审美疲劳,但豆包模型Seed 2.0不同,其核心是Skills调用能力。作者测试了它做的小红书长图文排版生成器和古文翻译器,还体验了APP“专家模式”,展现多模态理解优势。

刘言飞语
新闻资讯8

深度机智和他们的另一条路:用人类第一视角数据训练基座模型|甲子光年

3月27日,深度机智联合推出具身通用智能基座模型系统PhysBrain 1.0,引入人类第一视角数据,解决传统模型问题。其创始人陈凯等坚持用此数据构建模型,突破传统,引领行业新方向,且中国在具身智能领域或借此建立自主技术体系。

甲子光年
算法论文8

景不动人动,MLLM如何面对「移步换景」的真实世界?OST-Bench揭示多模态模型在线时空理解短板

上海多所高校研究者提出 OST - Bench,从智能体探索场景动态在线视角挑战模型能力。它更贴近真实世界,揭示主流多模态模型在线时空理解短板,为未来模型发展指明方向。

机器之心
7

模型如何赋能 Web 渗透测试?

文章指出传统Web安全检测有局限,而语言模型(LLM)可提升漏洞发现覆盖率与准确性。以mcp server为基础介绍自动化漏洞检测方案,还分享实践操作、遇到的问题及解决办法,分析其优缺点并给出拓展思路。

阿里云开发者
开源动态8

6.1B打平40B Dense模型,蚂蚁开源最新MoE模型Ling-flash-2.0

蚂蚁百灵模型团队开源 MoE 模型 Ling-flash-2.0,其以轻量级配置展现卓越性能,在推理速度、任务性能、部署成本间找到新平衡,为模型‘参数膨胀’提供新路径,还在多领域应用表现出色。

机器之心
新闻资讯8

模型第一股”打响上市前哨战!智谱GLM-4.7 刷新开源编程SOTA,修复代码、终端操作表现超Claude 4.5

冲刺模型第一股的智谱推出开源模型GLM - 4.7,主打编程与代理式任务提升。它在多项基准测试中表现出色,UI质量飞跃,还采用新推理机制。智谱上市在即,但亏损扩张快,研发投入

AI前线
8

对话百度文库:不做模型能直接做的事,能力积累换来竞争壁垒|AI产品Time

百度文库从文档检索平台转型为一站式AI内容获取和创作平台,付费用户超4000万,AI MAU近亿,智能PPT访问量全球第一。访谈中,负责人分享产品理念、优势及运营经验,如不走模型能直接做的事,从用户需求出发开发功能等。

量子位