「Docusaurus 3.9」共找到 2209 篇相关文章
分割一切、3D重建一切还不够,Meta开源SAM Audio分割一切声音
Meta 深夜放出音频分割模型 SAM Audio,可通过多模态提示分离任意声音。其核心 PE - AV 推动性能领先,还发布评测模型、基准等,整合进新平台,虽有局限但为音频 AI 带来新可能。
暴涨3倍!18-34岁占比反降15%:这届中年人开始占领AI
数字数据公司Similarweb发布《2025生成式AI全景报告》。显示全球GenAI平台访问量、App下载量增长,用户年龄层拓宽。ChatGPT跻身全球前五,与谷歌等形成新生态,市场走向多元,AI应用场景不断拓展。
GPT-5.2 上线!全面超越 Claude Opus4.5 及 Gemimi 3.0 Pro
OpenAI 正式宣布 GPT-5.2 全面上线,一口气推出三个版本。GPT-5.2 Thinking 在推理能力上拉开代差,是 OpenAI 首个达人类专家水平的模型。各版本定位清晰,不同用户使用时间有别。
Karpathy组建大模型「议会」,GPT-5.1、Gemini 3 Pro等化身最强智囊团
前OpenAI联合创始人Andrej Karpathy发推称养成用LLM阅读习惯,还做了个新项目,让四个最新大模型组成LLM议会当智囊团。项目是Web应用,提问后多模型处理,有互评和投票机制,已开源。
AI终于学会「读懂人心」,带飞DeepSeek R1,OpenAI o3等模型
威斯康星大学麦迪逊分校联合清华的研究《MetaMind: Modeling Human Social Thoughts with Metacognitive Multi-Agent Systems》,将元认知理论融入LLM架构,使模型在心智理论测试达人类平均水平,揭示构建社交智能AI方法论。
AI终于学会「读懂人心」,带飞DeepSeek R1,OpenAI o3等模型
威斯康星大学麦迪逊分校联合清华大学的研究《MetaMind: Modeling Human Social Thoughts with Metacognitive Multi-Agent Systems》,将元认知理论融入LLM架构,让AI“读懂人心”。其框架分三阶段,还有动态社交记忆,在多基准测试表现出色。
8.9K Star!号称 Notebook LM 开源平替,支持 16+AI 模型,一键部署!
Google Notebook LM 虽方便,但有数据泄露风险且被平台绑定。开源工具 `open-notebook` 是其平替,支持 16 + 家 AI 模型提供商,可处理多模态内容,能本地部署保障数据安全,还具备多种实用功能。
兄弟们,起飞啦,揭秘Claudable给你写代码的魔力 Github 3k star !!!
Claudable是Opactor AI组织开放的开源项目,它结合Claude Code强大的AI代理能力,能把自然语言描述的产品概念自动翻译成可部署的Web应用,解决传统Web开发痛点,功能强大且应用场景广泛。
全球仅9所,清华姚班校友当选!亚马逊AI博士奖学金豪掷6800万美元
亚马逊官宣AI博士奖学金,两年共6800万美金,为全球九所顶尖大学100多名博士生提供支持,资助智能体系统等硬核方向。目前,MIT、CMU、UC伯克利公布获奖名单,多位华人学者入选。
一张照片,一个3D「你」:计算所等提出HumanLift,实现高保真数字人重建
中国科学院计算技术研究所等机构研究人员提出 HumanLift 技术,基于单张参考图像重建高斯网数字人全身。该技术融合三维视频扩散模型和人脸增强,仅需单张人体图片就能重建高逼真三维数字人。