视觉 - 语言数据」共找到 3816 篇相关文章

推荐文章8

95% 企业 AI 落地失败当下,另外 5% 的 CIO 在谈什么?

文章指出 95% 企业 AI 落地失败,痛点在于认知难对齐、技术业务错配、价值度量模糊、数据底座不佳。阿里云蒋林泉等 CIO 探讨解法,提出 RIDE 方法论,还分享太古可口可乐、顺丰等企业的 AI 落地经验与智慧。

InfoQ
开源动态8

HF日趋榜一!真端到端模型AutoDeco终结手动调参解码

语言模型手动调参解码繁琐,腾讯AI Lab王琰团队联合港中大(深圳)唐晓莹教授团队推出AutoDeco架构,通过创新训练策略让模型动态预测解码参数,在多模型实验中表现出色且已开源。

机器之心
产品应用8

当搜索遇见 AIGC:京东零售的“千人千面”素材生成实践

在 AIGC 浪潮下,视觉生成技术重构电商生态。京东零售李岩介绍“千人千面”商品素材生成技术链路,包括关键模型及实现框架,还发布焕新版京点点平台并预告新能力,推动电商个性化变革。

InfoQ
算法论文8

让机器人在“想象”中学习世界的模型来了!PI联创课题组&清华陈建宇团队联合出品

斯坦福Chelsea Finn课题组与清华陈建宇团队联合提出可控生成世界模型Ctrl - World,可让机器人在“想象空间”预演任务。该模型使用零真机数据,提升下游任务指令跟随成功率。其相关论文已发布于arXiv平台。

量子位
产品应用7

Excel新AI插件!华尔街「表哥表姐」对手来了

Anthropic让Claude以插件形态接入Excel,可操作和读取数据、定位单元格内容并说明修改理由。还针对金融领域新增6项技能。Claude已被金融企业广泛使用,或取代金融从业者制表技巧,但核算准确性存疑。

新智元
算法论文7

VaseVQA:考古领域实现专家级,诊断+补弱RL框架

在文化遗产与人工智能交叉领域,研究人员提出把大型多模态模型放于‘诊断—补弱—精细化评估’闭环训练,配套结构化评测基准,让模型在文化遗产领域接近专家级能力。介绍了技术步骤、数据基准及关键发现等。

新智元
算法论文8

可攻可防,越狱成功率近90%!六大主流模型全中招 | EMNLP'25

研究人员聚焦大型语言模型(LLMs)安全漏洞,提出全新越狱攻击范式SCP与防御策略POSD。SCP基于DTD机制,在6个主流模型上平均攻击成功率达87.23%;POSD能有效抵御攻击,还提升模型泛化能力。

新智元
新闻资讯7

Qwen要做机器人了:林俊旸官宣成立具身智能团队

阿里通义千问大模型负责人林俊旸官宣在Qwen内组建小型机器人、具身智能团队。此前阿里云领投具身智能企业,Qwen系列模型受具身智能公司青睐,此次动作呼应阿里云布局,正值科技巨头加码机器人领域。

机器之心
算法论文8

从「知题」到「知人」:UserRL让智能体学会「以人为本」

语言模型距成真正用户伙伴缺‘知人’能力。来自UIUC与Salesforce团队提出UserBench和UserRL方案。前者将‘用户特性’制度化,构建评测环境;后者搭建统一强化学习框架,探索奖励建模,二者让‘以用户为中心’落地。

机器之心
开源动态8

LangExtract:用LLM 一键完成长文档信息抽取与可视化

在2025年大语言模型迅猛发展时,信息抽取成了NLP场景里的“硬骨头”。Google在7月30日开源的LangExtract利用多种LLM,实现“按指令抽取+源文对齐 + 一键可视化”的完整闭环,还给出使用步骤和进阶操作。

机器学习AI算法工程