多模态先验提示」共找到 1397 篇相关文章

开源动态7

15.1k,谷歌Notebook LM本地开源替代!

Open Notebook是开源、本地化且重隐私的Google Notebook LM替代方案。它支持超16家供应商,能整理多模态内容、生成专业播客,在多方面比Google Notebook LM更具优势。

PaperAgent
产品应用8

抛弃“级联”架构!快手OneRec用大模型重构推荐系统,服务成本降至1/10

传统级联式推荐架构有瓶颈,快手用OneRec重构推荐链路,服务成本降至1/10。文中介绍OneRec架构、Tokenizer方案、强化学习奖励设计,还提及优化及多模态联合训练方向。

InfoQ
新闻资讯8

全球首个真实世界具身多模态数据集,它石智航交卷,比特斯拉还早6个月

它石智航发布全球首个大规模真实世界具身VLTA多模态数据集WIYH,将于2025年12月开放。该数据集突破大,特点鲜明,优势明显,其发布填补数据空白,奠定以人为本范式。

量子位
开源动态8

2.1K Star 本地实时数字人!阿里开源低延迟数字人系统,2.2秒实时响应!

阿里在GitHub开源轻量本地实时数字人对话系统OpenAvatarChat,摆脱高性能硬件依赖等问题。它平均回答延迟2.2秒,有100+预置形象,支持多模态交互,提供多种部署方式,适配多场景。

开源星探
新闻资讯7

ChatGPT惊现“零点击攻击”,API密钥被轻松泄露,OpenAI暂未解决

ChatGPT存在“零点击攻击”安全问题,攻击者可通过向第三方应用文档注入恶意提示,窃取用户敏感数据和API密钥。OpenAI虽采取防范措施,但攻击者仍能绕过。专家为企业提出防范建议。

量子位
开源动态8

又一个Kimi K3下周开源!Qwen3.8-Max编程、办公、科研都能自己干了

Qwen3.8-Max是Qwen家族迄今最强模型,2.4万亿参数,下周将开源权重。它在多项基准测试中表现出色,能连续自主工作数天,在编程、办公、科研、长周期任务、多模态等方面全面提升。

AIGC开放社区
算法论文8

LangFlow: 挑战离散扩散,探索下一代语言模型新范式

UIUC Ge Liu团队发布《LangFlow: Continuous Flow Matching for Large Language Models》,回归连续扩散架构。研究指出连续扩散受挫非先天缺陷,经优化,LangFlow让连续扩散在标准基准追平离散扩散,为多模态统一架构打通底层路线。

机器之心
算法论文7

Google 新论文离谱到家了,0延迟0成本通用,提升大模型准确率最简单的方法。

Google新论文提出简单提升大模型准确率的方法,即重复提示词,把完全一致的输入连续发2次。主流模型适用,经70项benchmark测试,0场景效果倒退,47个场景准确率提升,且几乎不增延迟、成本。

探索AGI
开源动态8

刚刚国产双响炮炸场!智谱「牛来模型」和阿里Qwen3.8-Flash双双亮相屠榜

智谱发布GLM - 5.3 - Flash(牛来模型),原生多模态,支持1M token上下文,运行在国产芯片,价格实惠。阿里开源Qwen3.8 - Flash - Next权重,成本低性能优,在四大维度重构架构。

AI寒武纪
开源动态8

硅谷豪赌算力烧到停电,中国团队反向出击!这一刀,直接砍碎Scaling Law

硅谷陷入算力战争,OpenAI、马斯克等豪赌Scaling。但Anthropic指出模型大、算力多不一定聪明。Yuan 3.0 Flash登场,用RAPO+RIRM解决过度思考,降低推理token,在多模态任务表现出色,引发开发者关注。

新智元