超节点架构」共找到 3792 篇相关文章

开源动态8

准确回答视频细节!11B模型挑战视频理解「证据级」任务,开源可商用

近日,复旦大学邱锡鹏教授领衔的OpenMOSS团队联合模思智能开源11B参数的多模态视觉理解模型MOSS-VL。它能准确回答视频里可被验证的细节、时间、过程和空间关系,有六项证据级能力,架构设计独特,采用Apache2.0开源许可。

量子位
产品应用7

DeepSeek识图模式是个新模型?!一手实测在此(没错我被灰度到了)

作者喜提DeepSeek识图模式灰度测试,实测发现其非思考模式速度快,推理有幻觉;思考模式推理慢且冗长。实用功能如OCR、复原HTML较靠谱,但色盲测试偶翻车。该模式或用独立视觉模型,且多模态进展预期。

量子位
新闻资讯8

神秘爆款模型被小米认领!雷军直言过马斯克 xAI Grok,罗福莉透露MiMo-V2-Pro将开源

小米发布 MiMo-V2 家族三款新模型,确认 Hunter Alpha 是 MiMo-V2-Pro 早期版本。雷军称其马斯克 Grok,罗福莉透露模型稳定后将开源。MiMo-V2-Pro 适用于 Agent 场景,Omni 关注全模态交互,TTS 面向语音生成。

InfoQ
8

老黄亲自打钱!马斯克一夜狂融1400亿,百万GPU豪赌AGI终局

马斯克的xAI获200亿美元E轮融资,英伟达等参投。xAI估值逼近OpenAI,手握百万GPU,Grok 5在训。马斯克称2026年AGI降临,AI将冲击就业,xAI有望成谷歌对手,不过Grok也陷入‘脱衣’风波。

新智元
产品应用7

OPPO新AI操作系统,走出屏幕“指哪答哪”,嘈杂环境只听你声音

OPPO新一代AIOS ColorOS 16来了,“一键闪记”和“一键问屏”功能有新玩法。“一键闪记”能记取餐码等,还会“记忆共生”;“一键问屏”走出屏幕,嘈杂环境也能只听你声音。此外,OPPO宣布全新AI技术架构

量子位
新闻资讯7

AI 写代码太烧钱了:Copilot、Claude 一起涨价,不如把程序员请回来?

GitHub与Anthropic几乎同时调整AI写代码收费模式,GitHub Copilot按使用量计费,Claude Code限制Opus模型访问。AI公司此前靠低价扩张,如今成本压力大,将成本转嫁到用户,而很多token被浪费,AI使用成本可能程序员。

InfoQ
开源动态8

断网可用!首款全双工全模态大模型技术报告发布,附一键安装包

面壁智能等联合发布MiniCPM-o 4.5技术报告,它是业界首个端到端全双工全模态大模型,采用Omni - Flow架构。同步推出在线Demo、API、端侧安装包等,低显存GPU即可运行,性能表现优秀,应用潜力大。

新智元
开源动态8

谷歌开源“Agent Skill 级工具箱”,云、库、引擎、AI全线打通,开发者狂喜

在大模型竞争白热化背景下,谷歌为解决开发者难题推出 Agent Skills。官方仓库含多项技能,涵盖谷歌云核心服务及架构支柱技能,还提供常见任务流程指南,兼容多平台,能省开发代码。此前还有 Addy Osmani 开源的技能库。

InfoQ
产品应用8

Harness Engineering:AI 能在真正"出事会炸"的后端系统里写代码吗?

文章围绕AI能否在后端系统写代码展开,以腾讯CDN LEGO项目为例,介绍了项目背景与挑战,通过nonstop项目探测AI编码能力,分析AI Coding易翻车的问题及根因,构建Harness Engineering架构并实践,最终效率提升20%。

腾讯技术工程
开源动态8

Qwen3-ASR开源:够稳定,能流式,多语言!

今日正式开源Qwen3-ASR系列模型,含两个语音识别与一个语音强制对齐模型,支持多语种。依托创新技术实现精准稳定识别,1.7B模型多场景达SOTA,0.6B兼顾性能效率,强制对齐模型精度传统模型。

千问Qwen