多视角数据」共找到 6060 篇相关文章

开源动态8

阿里 Qwen3:持续开源,SOTA 连连!

从业者有‘闭源模型一定比开源强’的刻板印象,而 Qwen 正打破此认知。最近阿里连发三款模型 Qwen3-235B、Qwen3-Coder、Qwen3-235B(Thinking),在方向发力且拿下个开源榜单第一。

特工宇宙
产品应用8

Tair 短期记忆架构实践:淘宝闪购 AI Agent 的秒级响应记忆系统

本文从淘宝闪购与千问合作的‘一句话点外卖’项目出发,介绍 Tair 在 AI Agent 记忆管理中的数据模型设计、压缩策略与并发控制等关键实践,展示其在低延迟、数据建模、并发安全和弹性抗压等方面的能力。

阿里云开发者
新闻资讯8

全国产算力托底、告别 AI 内卷,科大讯飞如何让每个人站在 AI 肩膀上?

本文围绕科大讯飞在AI领域的发展展开。董事长刘庆峰表示要让所有人共享AI红利,介绍了公司在领域的应用成果,还发布全国产算力的讯飞星火X1.5模型,实现项技术突破,推动AI融入现实生活。

AI前线
算法论文8

AI在线强化学习“边做边学”,斯坦福团队让7B小模型性能飙升,甚至超越GPT-4o

斯坦福等团队提出新范式AgentFlow,由四个智能体组成,用在线强化学习持续提升智能体系统推理能力。以Qwen - 2.5 - 7B - Instruct为基座模型的它在基准测试表现突出,甚至超越GPT - 4o等大模型。

量子位
新闻资讯7

AI原生产品不等于全部功能AI化,保留传统功能让用户体验更完整 | 对话小卡健康

AI健康管理赛道竞争激烈,产品各有差异。量子位智库访谈小卡健康产品负责人李雅,探讨AI如何赋能、产品功能拓展、数据指标关注、智能设备联动、开发问题及运营推广等,展示其差异化策略和发展思考。

量子位
开源动态8

5B参数+4060Ti,10秒出图,全流程开源可复现!补齐统一模态生成编辑的开源版图,让高质量图像生成真正变得更轻量、更普及

近日,机构联合发布统一模态生成编辑模型DeepGen 1.0,仅5B参数,集成五大能力,4060ti 16G上10秒出图,项指标超大4倍工业级模型。团队开源全流程代码与数据,可从零复现。

量子位
新闻资讯7

ChatGPT本来要5天后关掉

翁家翌在播客透露,起初推出ChatGPT是为收集用户数据,预期5天后关闭。他是OpenAI代大模型发布贡献者,还分享了OpenAI内部情况,如模型训练、迭代速度等问题,也谈及自身经历和对AGI看法。

花叔
开源动态8

社区供稿丨MiniCPM-V 4.5 技术报告正式出炉

上个月开源的模态模型 MiniCPM-V 4.5 广受好评,今日其技术报告出炉。报告从架构、数据和训练三方面探索高效路径,提出三大技术,使模型在任务上突破,小参数规模下性能和推理速度佳。

Hugging Face
产品应用8

阿里发布Qwen3-TTS:跨语言混合无缝切换,方言音色全面覆盖!

TTS技术从单一合成进化到模态表达,但传统模型在跨语言/方言混合场景有不足,商业工具费用高且不开源,开源方案训练数据少。阿里推出Qwen3 - TTS,实现人类级自然度和表现力,功能强大,应用场景

开源星探
算法论文8

对噢!为什么LMs就不能直接输出答案+confidence呢?

当前语言模型在复杂问答任务中存在校准退化问题,本文提出RLCR方法,将概率校准融入RL训练目标,重构奖励函数,在数据集实验中显著降低校准误差,不损失准确性,为高风险场景AI部署奠基。

深度学习自然语言处理