多任务能力」共找到 7228 篇相关文章

算法论文8

北大联手通义实验室发布ZeroSearch:成本暴降88%,无需搜索即可激活大语言模型的检索能力

北大与通义实验室发布ZeroSearch框架,可无需真实搜索激活大语言模型检索能力。它引入大语言模型模拟搜索、采用结构化模板等策略,成本降88%,项实验显示其性能超越基线与真实搜索方法。

深度学习自然语言处理
产品应用8

QwenLong-L1.5发布:一套配方,三大法宝,让30B MoE模型长文本推理能力媲美GPT-5

通义文档智能团队推出QwenLong - L1.5长文本推理专家,提供端到端长文本推理后训练“配方”,含数据合成管线、强化学习方法、智能体架构,在基准测试成绩佳,代码已开源。

机器之心
新闻资讯7

取消AI考核、零裁员!股价暴跌82%后,邻国走出了一条反硅谷之路

邻国曾是 AI 转型标杆,股价一度暴涨,但近一年暴跌 80%。创始人 Luis von Ahn 表示不裁员,曾将 AI 应用纳入考核又取消,分享员工用 AI 开发课程案例,还谈了 AI 局限、对行业影响及公司应对策略。

AI前线
算法论文8

在AI社会抓「内鬼」?上海AI Lab推出首个智能体极端事件解释框架

2023年起智能体系统成人类社会数字镜像,但复杂系统会自发涌现极端事件。上海AI Lab等团队推出解释框架,用沙普利值拆解风险,发现极端事件五大演化规律,还能提前防控风险。

机器之心
算法论文8

清华校友出手,8B硬刚GPT-4o!单一模型无限工具调用,终结智能体

MIT等机构推出TIM和TIMRUN组合拳,突破模型token天花板。TIM将推理建模为任务树,TIMRUN优化内存管理。二者结合支持长程推理,实现单模型高效推理,简化智能体构建,在方面表现出色。

新智元
开源动态8

QwenLong-L1.5发布:一套配方,三大法宝,让30B MoE模型长文本推理能力媲美GPT-5

通义文档智能团队推出QwenLong - L1.5,提供长文本推理后训练“配方”,含数据合成管线、强化学习方法和智能体架构。通过三大“法宝”重塑模型能力,效果显著,相关代码已开源。

AINLPer
算法论文8

何恺明带大二本科生颠覆扩散图像生成:扔掉步采样和潜空间,一步像素直出

何恺明团队提出新方法Pixel Mean Flow(pMF),突破传统扩散模型/流模型限制,砍掉步采样和潜空间,一步在像素空间生成图像,在ImageNet不同分辨率上取得佳成绩,还介绍了核心设计、实验结果对比等。

量子位
产品应用7

Seedance 2.5 专业创作实测:3D导演台、局部重改、角色库如何释放模型能力

Seedance 2.5升级,3D导演台自带图片生成白模功能、打通3D工作流;有片段重拍实用功能;小云雀升级角色资产能力。除素材增加,其更理解原视频创意逻辑,还有模态参考等功能,降低创作门槛。

AI进修生
开源动态8

性能提升84%-166%!L-Zero仅靠强化学习解锁大模型探索世界的能力 | 已开源

招商局狮子山人工智能实验室团队用RLVR让模型“自学”,构建L0系统,含NB - Agent框架和端到端强化学习训练流程,开源相关内容。测试显示L0显著提升模型性能,展现强大泛化能力

量子位
开源动态8

腾讯开源混元世界模型1.1,视频秒变3D世界,单卡推理仅需1秒

腾讯发布并开源混元世界模型1.1,是统一的端到端3D重建基座大模型。它支持从视图或视频一键生成3D世界,单卡秒级推理完成高精度重建,性能达SOTA,还具特性,打破技术壁垒。

量子位