视觉语言导航」共找到 1627 篇相关文章

开源动态7

数据与舆情双引擎:DeepAnalyze + BettaFish

DeepAnalyze是面向自主数据科学的大语言模型,能自动完成数据科学任务,支持完整流程、开放式研究且完全开源。还提出两项关键技术。微舆 - BettaFish是舆情分析系统,四类智能体协同工作,有六大核心优势。

带你学AI
开源动态8

HF日趋榜一!真端到端模型AutoDeco终结手动调参解码

语言模型手动调参解码繁琐,腾讯AI Lab王琰团队联合港中大(深圳)唐晓莹教授团队推出AutoDeco架构,通过创新训练策略让模型动态预测解码参数,在多模型实验中表现出色且已开源。

机器之心
产品应用8

当搜索遇见 AIGC:京东零售的“千人千面”素材生成实践

在 AIGC 浪潮下,视觉生成技术重构电商生态。京东零售李岩介绍“千人千面”商品素材生成技术链路,包括关键模型及实现框架,还发布焕新版京点点平台并预告新能力,推动电商个性化变革。

InfoQ
开源动态8

达摩院推出多智能体框架ReasonMed,打造医学推理数据生成新范式

在人工智能领域,推理语言模型在医学场景应用存在挑战,达摩院推出多智能体框架ReasonMed,提出医学推理数据生成新范式,开源百万级高质量数据集ReasonMed370K,验证了‘小模型 + 高质量数据’的潜力。

机器之心
算法论文8

可攻可防,越狱成功率近90%!六大主流模型全中招 | EMNLP'25

研究人员聚焦大型语言模型(LLMs)安全漏洞,提出全新越狱攻击范式SCP与防御策略POSD。SCP基于DTD机制,在6个主流模型上平均攻击成功率达87.23%;POSD能有效抵御攻击,还提升模型泛化能力。

新智元
新闻资讯7

Qwen要做机器人了:林俊旸官宣成立具身智能团队

阿里通义千问大模型负责人林俊旸官宣在Qwen内组建小型机器人、具身智能团队。此前阿里云领投具身智能企业,Qwen系列模型受具身智能公司青睐,此次动作呼应阿里云布局,正值科技巨头加码机器人领域。

机器之心
算法论文8

从「知题」到「知人」:UserRL让智能体学会「以人为本」

语言模型距成真正用户伙伴缺‘知人’能力。来自UIUC与Salesforce团队提出UserBench和UserRL方案。前者将‘用户特性’制度化,构建评测环境;后者搭建统一强化学习框架,探索奖励建模,二者让‘以用户为中心’落地。

机器之心
开源动态8

LangExtract:用LLM 一键完成长文档信息抽取与可视化

在2025年大语言模型迅猛发展时,信息抽取成了NLP场景里的“硬骨头”。Google在7月30日开源的LangExtract利用多种LLM,实现“按指令抽取+源文对齐 + 一键可视化”的完整闭环,还给出使用步骤和进阶操作。

机器学习AI算法工程
推荐文章7

Learn to Reason _ The way of Baichuan-M1-ClinicReasoning

前百川智能研究小组负责人阎栋分享大语言模型临床推理。回顾推理技术发展,以Deepseek为例;介绍百川在医疗推理实践,模型达三甲主治水平;还谈及大模型训练困境及与人类智能差异。

InfoQ
8

100 页 Agentic RL 综述!牛津、新国立、AI Lab 等联合定义 LLM 下半场

2025 年大语言模型热潮持续,但当前主流训练范式显瓶颈。牛津、新国立等 16 家机构学者发布 100 页 Agentic RL 综述,明确定义从‘会说’到‘会做’进化路径,剖析理论、结构与实践,展望未来挑战。

特工宇宙