「中国开源力量」共找到 3737 篇相关文章
原来这届中国AI年轻人,已经卷到业界都惊了
在小红书上,一群热爱技术的年轻人搞了一场为期五个多月的腾讯广告算法大赛。赛题是全模态生成式推荐,考验选手探索精神。比赛结束后,表现突出选手将被纳入腾讯“青云计划”。
Meta发布Omnilingual ASR:支持1600+语言的开源语音识别系统
Meta发布全新自动语音识别系统Omnilingual ASR,支持超1600种语言,核心创新是零样本和少样本学习能力,降低小语种语音识别门槛。项目提供不同规模模型,安装调用简单,目前仅支持40秒内音频,数据集和项目均开源。
NVIDIA重磅开源!OmniVinci 仅 9B 模型就拿下多模态冠军!
英伟达推出全模态大语言模型 OmniVinci,架构有三大创新。OmniVinci - 9B 模型表现亮眼,多测试中大幅超 Qwen2.5 - Omni,且训练量仅为其六分之一。其架构经多阶段流程实现全模态理解,还支持多种功能。
LeCun预言成真!790年长视频,炼出最强开源「世界模型」
2025年‘世界模型’成AI巨头战场,谷歌、李飞飞团队等纷纷布局。上周北京智源研究院发布Emu3.5,340亿参数,基于790年长视频数据训练,其架构优越,推理快,能力强,还公开技术报告邀全球探索。
AI圈再颠覆!中国AI翻译耳机通话翻译,实测震撼
科大讯飞发布全新AI翻译耳机,上海与迪拜连线对话实测表现震撼,响应延迟低至两秒。其集成“端到端语音同传”技术,采用“骨导+气导”设计。此外,翻译机2.0也升级,科大讯飞在AI翻译领域优势显著。
继封禁中国公司后,Anthropic 刚刚宣布:支持SB 53 法案
Anthropic宣布支持SB 53法案,认为其为监管强大AI系统提供基础,通过透明度实现监管。该法案对大型AI公司提出多项要求,不过部分强大模型或不被涵盖。其他主要AI公司和部分风投机构则抵制该法案。
腾讯重磅开源!端到端视频音效生成模型HunyuanVideo-Foley
腾讯混元正式开源端到端视频音效生成模型 HunyuanVideo-Foley,适用于多场景。它采用新型框架结合 REPA 策略,有三大核心优势,能适配多种场景,抑制底噪,保证音频保真度。
我只推荐这5个!24个开源Agent/Workflow框架大比拼!
文章围绕《A Survey on Agent Workflow》展开,介绍了Agent Workflow概念、与Multi - Agent差异、核心组成及Agent角色。对24个主流框架进行对比,还给出不同场景下的框架选择建议,指出当前框架缺乏统一标准。
科研写作神器,超越Mathpix的科学公式提取工具已开源
LaTeX公式OCR现有方法处理真实文献面临挑战,DocTron团队提出系统性方案。构建CSFormula数据集,提出DocTron - Formula模型,在评测和实际应用中表现出色,超越Mathpix等工具。
重塑AI记忆边界:MemOS开源!时序推理较OpenAI提升159%
近日,记忆张量等多家团队发布面向大模型的工业级记忆操作系统MemOS。它借鉴传统操作系统架构,实现AI记忆结构化管理,性能超OpenAI等方案,未来将成立社区、推进应用及持续迭代。