「多模态智能」共找到 4139 篇相关文章
英伟达成开源新王?Nemotron 3全新混合专家架构,推理效率升4倍
北京时间今天凌晨,英伟达发布 Nemotron 3 系列开放模型,含 Nano、Super 和 Ultra 三种规模。Nano 已上线 Hugging Face,采用混合 MoE 架构,推理效率提升显著。该系列还具备多种核心技术和实用能力,相关工具和数据集也已开源。
DeepMind科学家惊人预测:AGI在2028年实现,大规模失业要来了
Google DeepMind首席AGI科学家Shane Legg预测,最小AGI有50%概率在2028年实现,完全AGI将在其后3 - 6年出现,最终会诞生超越人类的ASI。这将带来变革,也引发失业担忧,需提前准备。
OpenAI十周年「血色浪漫」:11位联创出走8位,奥特曼深夜发文
OpenAI迎来十周年,发布短片回顾发展。过去11位联创出走8位,奥特曼发文揭秘细节,称吃到时代红利。新晋女高管分享炼成秘诀,如研究驱动产品、自下而上创新、重视安全等。
ChatGPT开始搞社交了
谷歌狂放大招,ChatGPT更新群聊功能,与微信、QQ群聊神似,还能让聊天机器人判断群气氛决定发言。不久前奥特曼称不做社交,此次更新被指仓促,未直击痛点、缺乏技术突破。
HexStrike代理:让大模型继承专家经验,显著提升渗透测试效率
HexStrike是开源渗透测试工具,以MCP为底座。其核心智能组件IntelligentDecisionEngine是专家系统,将安全专家经验规则化,通过知识库和算法提供工具选择和参数优化,提升渗透测试效率。
阿里开源SmartResume,简历解析无需手工
阿里在Hugging Face和ModelScope上开源智能简历解析系统SmartResume,能将多种格式简历转为结构化数据,分三阶段工作,性能优于基线方法,为HR和开发者提供工具。
开源即爆火!英伟达重磅推出OmniVinci全模态大模型
英伟达在华盛顿GTC大会开源OmniVinci全模态大语言模型,实现视觉、音频、语言统一理解。它性能超竞品,架构有创新,数据引擎庞大。实验有重要洞察,在多场景表现佳,代表全新AI范式。
让模型“看视频写网页”,GPT-5仅得36.35分!上海AI Lab联合发布首个video2code基准
上海人工智能实验室等机构提出IWR - Bench评测基准,从“image - to - code”迈向“video - to - code”,对28个主流模型测试,最佳模型GPT - 5仅36.35分,指出当前模型短板,为研究指明方向。
量化投资和金融科技的开源利器来了!
金融强化学习 (FinRL®) 是首个面向金融强化学习的开源框架,已发展成生态系统,有三层结构。其特点包括支持多算法、多市场环境模拟等,有完整流水线,还支持多数据源。
刚刚,「PyTorch之王」携15亿薪酬杀回Meta!史上最贵AI天才巨星诞生
WSJ爆料,Thinking Machines联创、「PyTorch之王」Andrew Tulloch回归Meta,本人已内部信官宣。他曾拒15亿美元薪酬,此前在Meta干11年,后加入OpenAI。Meta斥资猛攻AI,四处挖角重组团队。