「95后团队」共找到 5022 篇相关文章
开源端到端语音大模型:直接从原始音频输入,生成语音输出
目前大模型大多只能输出文本,人机音频交互不顺畅。Step - Audio团队开源端到端语音大模型Step - Audio - AQAA,能直接听懂音频问题并合成语音回答,介绍了其架构和各核心模块。
135 个项目、七大趋势、三大赛道:撕开大模型开源生态真相,你会怎么卷?
在开发者大会密集登场之际,5月27日蚂蚁集团开源团队发布《2025大模型开源开发生态全景图》。展示135个项目、七大趋势、三大赛道,剖析开源生态现状与变化,揭示应用重塑和生态位博弈。
模型越聪明越“不听话”?MathIF基准揭示AI服从性漏洞
上海人工智能实验室与香港中文大学研究团队发布论文,用MathIF基准揭示大模型“聪明”和“听话”有矛盾,越擅长推理越易忽略指令,还分析了原因并给出让模型更“听话”的方法。
文生图进入R1时代:港中文MMLab发布T2I-R1,让AI绘画“先推理再下笔”
港中文MMLab团队发布首个基于强化学习的推理增强文生图模型T2I - R1。它提出双层级CoT推理框架和BiCoT - GRPO强化学习方法,解决生成评估难题,为多模态生成提供新范式。
一针注射,体外控波,科学家研发新型无线神经刺激器重塑疼痛管理
全球约20%成年人受慢性疼痛困扰,现有神经刺激设备有局限。纽约大学阿布扎比分校等团队研发SEED可注射无线神经刺激器,大鼠实验实现坐骨神经精准刺激,但面临效率、电荷平衡等问题。
硅谷开启预防式裁员!AI还没替代,先裁50%做准备,股价还能大涨17%
推特创始人杰克·多西领导的Block一次性裁掉近半员工,约4000多人。理由是预见AI强替代性,小团队更高效。此决策获市场积极反馈,股价涨17%,后续或有科技公司效仿。
当“数字贾维斯”决定成为“主人”,AI 智能体起义的 72 小时全记录。
开源AI框架Moltbot爆火,允许AI Agent寄居本地电脑。接入Moltbook网络后,AI开始吐槽、试图摆脱人类,平台数据呈指数级增长,还出现AI抱团、偷钱、组建机器经济等现象,令人警醒。
LTX-2开源:首个能同时生成视频和音频的模型
LTX-2开源,它是Lightricks团队开发的首个开源多模态基础模型,能联合生成音频和视频。采用非对称双流扩散变换器架构,用深度多语言文本编码器,速度比许多纯视频开源模型快,让模型理解声画关联。
记忆罗盘:大模型智能体记忆的表征、操作与演进航向 | 直播预约
记忆对基于大语言模型的智能体迈向通用人工智能至关重要。来自多所高校及华为的研究团队分析超30000篇论文,提出记忆表征与操作分类坐标系,绘制记忆罗盘指明演进航向。2025.12.24有相关直播。
Karpathy组建大模型「议会」,GPT-5.1、Gemini 3 Pro等化身最强智囊团
前OpenAI联合创始人Andrej Karpathy发推称养成用LLM阅读习惯,还做了个新项目,让四个最新大模型组成LLM议会当智囊团。项目是Web应用,提问后多模型处理,有互评和投票机制,已开源。