「后Transformer架构」共找到 3752 篇相关文章
刷屏的SBTI,底层算法有点东西…
近期SBTI人格测试爆火,它出自B站UP主Q肉儿串儿,初衷是劝朋友戒酒。经分析,它大概率是“人工主导+AI辅助”的产物,技术架构简单,算法逻辑是答题拆维度、分数归档、模板匹配。此外,还有大神网友推出MBAI版测试题。
Ψ₀刚刚开源了!迈向通用人形机器人的基座模型
南加州大学团队开源迈向通用人形机器人的基座模型Ψ₀,仅需80条真机遥操作数据,在总体任务成功率和子任务指标上平均领先NVIDIA最新开源模型GR00T N1.6超40%,还介绍了其数据、训练、架构等方面。
100年后 K8s 还会存在吗?创始人 Brendan Burns:它将像 Linux 一样消失在 AI 之下
Kubernetes联合创始人Brendan Burns在访谈中回顾其诞生背景,指出Google开源K8s是为掌握技术演进主导权。他认为K8s虽成事实标准,但也有上限,未来或如Linux般成底层系统,100年后难原封不动存在。
陶哲轩:AI 已经把想法成本降到几乎为0了...
著名数学家陶哲轩在与播客主持人Dwarkesh Patel的对谈中分享使用AI一年后的观点,认为AI已将想法生成成本降至几乎为零,但验证和评估成新瓶颈,还探讨其对数学研究的影响及未来发展。
Dense、MoE之外第三条Scaling路径:交大提出JTok模块,省1/3算力
上海交通大学与小红书Hi Lab联合团队提出JTok/JTok - M模块,作为插件挂载在Transformer层,几乎不增算力和显存开销却显著提升性能。该模块构建新scaling路径,在多任务测试中全面提分,为大模型发展提供新方向。
刚刚,面壁小钢炮开源进阶版「Her」,9B模型居然有了「活人感」
2月4日,面壁开源全双工全模态大模型MiniCPM - o 4.5,在多方面达SOTA水平。它能边看边听边说,实现自主交互。实测中表现如真人,其架构和机制有创新,还适合端侧部署,或开启人机交互新时代。
飞书合作的第一款AI硬件来了,居然是个AI录音豆。
飞书与安克创新合作推出首款AI硬件——AI录音豆。该产品小巧便携,可夹在衣服或吸附金属上,有飞书生态,录音质量好,自带底噪抑制,录音后能自动同步云端,快速生成会议纪要,还支持实时翻译。
Manus 加入 Meta,1 年内公司价值 100 倍增长,他们做对了什么?
Manus 加入 Meta 后公司价值一年涨百倍,其虽无自有模型却受海外巨头青睐。它靠增量思维获产业认可,借先发红利快速获高 ARR 与估值。后续应塑造爆款场景,创业者和大厂都可借鉴其思路。
社区供稿丨Jina-VLM:可在笔记本上跑的多语言视觉小模型
Jina AI发布2.4B参数量的视觉语言模型Jina - VLM,在多语言视觉问答任务达SOTA。它引入注意力池化,连接视觉与语言基座,处理问答等任务,对硬件要求低,多项测试表现优,还介绍架构、训练策略和上手方式。
理想的眼镜,和李想的眼界
今年11月,李想称要让理想成具身智能领域最佳企业。一周后,理想发布AI眼镜Livis。Livis解决了轻便、续航与性能的矛盾,还利用造车积累实现资产复用。理想推它是因AI眼镜潜力大,能输出跨场景AI能力。