大模型应用」共找到 10085 篇相关文章

算法论文8

Speech LLM 的下一个突破口:你的语音模型可以是个「带韵律的文本模型

语音模型存在‘模态代沟’致性能‘降智’,此前两波改进未根本解决。香港中文学论文提出TextPro - SLM架构,从输入端破局,仅用约1000小时数据就实现低‘模态代沟’,对多模态模型设计有启发。

机器之心
开源动态8

AI操作网页:browser-use和AI模型互动解析

文章深入解析开源框架browser - use与AI模型互动方式。它能自动化在线任务,靠精巧prompt设计和不同类型Message输入实现高效交互,还总结出可用于其他模型交互场景的技巧。

阿里云开发者
算法论文8

模型“吃一堑长一智”,南理工百度等提出模型记忆新方法

南京理工学联合百度等提出新方法ViLoMem,构建视觉流+逻辑流的双流语义记忆,让模型“从错误中学习”。它能在多模态基准提升模型表现,强模型记忆还可迁移给小模型

量子位
产品应用7

AI应用如何落地政企?首先不要卷通用模型

ISC.AI 2025会显示智能体技术加速渗透产业。360政企AI业务与智能体深度绑定,其落地有三重逻辑:不追通用模型,聚焦小场景;用“乐高式”工厂赋能;安全与AI深度融合是必选项。

量子位
开源动态8

阿里云通义点金发布DianJin-R1金融领域推理模型,32B模型荣膺榜首

阿里云通义点金团队与苏州学合作推出DianJin-R1金融领域推理模型,介绍其开源数据集与模型、基于通义点金平台的数据合成,展示了其在性能测试中的优异表现,推动金融科技智能化进程。

机器之心
开源动态8

一个模型读懂所有医学数据,Hulu-Med探索医学模型开源新范式 | 浙x上交xUIUC

Hulu - Med是浙、上交、UIUC等联合提出的通用医学视觉语言模型,首次在单一模型统一理解医学多类数据。它开源透明,训练成本低,性能媲美GPT - 4.1,为医学AI带来新范式。

量子位
新闻资讯8

Hinton上海演讲:模型跟人类智能很像,警惕养虎为患

深度学习之父Hinton在上海演讲《数字智能是否会取代生物智能》,指出人类可能是语言模型,也会有幻觉,但语言模型优于人类脑,知识传递高效。他呼吁建立国际社群,培养不夺权的好AI。

量子位
开源动态8

不只DeepSeek,阶跃等开源JetSpec:模型解码提速近10倍

近期,DeepSeek 推出 DSpark,阶跃星辰提出 JetSpec,都关注模型推理效率。DSpark 关注验证效率,JetSpec 提高有效 Token 生成率。二者切入点不同,但都显示模型行业进入新阶段,推理效率成 Agent 落地基础变量。

机器之心
新闻资讯8

《多模态语言模型技术发展报告》正式发布 | 中科算网算泥社区

2月5日,中科算网算泥社区发布《多模态语言模型技术发展报告》。报告回顾多模态模型发展历程,剖析核心技术创新,展示应用实践,分析挑战与机遇,为各界提供参考,推动多模态AI技术发展。

AIGC开放社区
新闻资讯7

官宣!姚顺雨出任腾讯首席AI科学家,带队语言模型、AI Infra

12月17日腾讯官方消息,腾讯升级模型研发架构,新成立AI Infra部等。姚顺雨出任首席AI科学家,兼任AI Infra部、语言模型部负责人,他在智能体方向成果多,论文总引用超1.9万。

机器之心