「AI大模型系统」共找到 14095 篇相关文章
21.7K 标星的开源TTS!FishAudio开源情感语音核弹:200万小时炼成“声优AI”!
FishAudio团队推出新一代TTS语音模型OpenAudio S1,基于200万小时音频数据训练,采用Qwen3+Descript Audio Codec架构。它能实现情感表达,在TTS - Arena榜单登顶,还提供不同版本适配,适用场景广泛。
3晚攻克世界数学难题,黑洞方程秒解!OpenAI:AI正让科学加速100年
2026年,AI成科学家新战友。数学家Ryu用ChatGPT三晚攻克优化难题;物理学者Lupsasca用GPT - 5 Pro 18分钟重现黑洞隐藏对称性;OpenAI为生物领域构建GPT - 4B Micro助力攻克难题。OpenAI称科学加速时代来临。
全球首个人形机器人通用视觉感知系统,Humanoid Occupancy建立多模态环境理解新范式
北京人形机器人创新中心推出 Humanoid Occupancy 感知系统,创新性融合多模态传感器信息,构建通用感知框架。它以语义占用表征为核心,有全编码和适配融合优势,经实验验证性能优,推动机器人迈向通用感知时代。
10% KV Cache实现无损数学推理!这个开源方法解决推理大模型「记忆过载」难题
推理大模型推理时易现冗余问题,R-KV开源方法登场,显存降90%、吞吐提6.6倍、准确率达100%。它通过实时对token排序解决冗余,还经多步骤压缩KV缓存,性能测试表现出色,适用多场景。
股价暴涨32%!GLM-5登顶全球开源第一,25分钟一镜到底搓出完整系统
2026年初,智谱GLM - 5上线,它是全球首个在系统级工程能力上与硅谷巨头正面竞争的开源模型,发布后智谱股价暴涨32%。它能力惊艳,能完成复杂项目,成本可控,还适配国产算力。
华为开源7B多模态模型,视觉定位和OCR能力出色,你的昇腾端侧“新甜点”来了
华为推出开源多模态模型openPangu-VL-7B,适配昇腾端侧。它推理性能性价比高,在多核心任务表现突出,技术报告还披露核心技术细节,为昇腾使用者带来新选择,丰富昇腾生态。
Transformer开始构建三维世界:开源模型几张图片秒级生成可探索3D场景
影溯将最新研究成果做成免费3D捕捉工具Crystal空间相机,背后技术QuerySplat已开源。其模型Topos - Lite改变组织三维空间方式,少量图片就能秒级生成3D场景,还能扩展容量。影溯团队经验丰富,技术应用场景广。
AI终端驱动下的芯片产业:新周期的起点与方向|甲子引力X
在8月21日的投资大会上,六位半导体领域顶级投资人剖析AI时代芯片破局路。他们认为中国虽在核心制造与软件生态是“跟随者”,但贴近终端等构成独特优势,还探讨突破壁垒、应对困境之法及未来投资方向。
“我让AI在我的电脑上为所欲为!”MoltBook创始人:爆火的技术,其实简单到离谱
MoltBook创始人Peter Steinberger称其是OpenClaw的延伸,外界对它解读“戏剧化”,但从技术角度看没什么震撼之处。真正关键的是敢让模型在电脑上自由运行,他还想让Agent“做梦”,项目会保持开源。
李飞飞押注的空间智能:生成的世界,如何「经得起折腾」?
李飞飞押注的空间智能是世界模型主流路线之一,旨在让AI生成可操作三维世界。但当前AI生成世界存在“中看不中用”问题,构建“站得住”的世界面临速度与状态瓶颈,生境科技等实践提供了解决思路。