「潜空间推理」共找到 2449 篇相关文章
jiSGLang集成ktransformers:2TB内存运行Kimi K2 Thinking模型
对于内存多但GPU资源有限的用户,SGLang集成ktransformers的CPU内核,支持直接运行Kimi K2 Thinking模型。它无需等量化,还能微调,虽性能与GPU方案有差距,但给用户新选择。
首次公开!奥特曼重新发明了浏览器
OpenAI首个浏览器Atlas背后技术秘密公开,关键创新是全新架构OWL。它将Atlas应用与Chromium运行时分离,带来即时启动等优势,还为AI智能体用例奠定基础,重构了UI体验。
Soul APP开源了一款高保真播客生成框架,90 分钟对话零崩盘!
Soul APP背后的Soul AI Lab发布开源项目SoulX - Podcast,是高保真推理框架,能生成90分钟以上连贯对话,有多方言切换等功能,或重塑语音内容产业生产方式。
清华、快手提出AttnRL:让大模型用「注意力」探索
清华和快手团队提出新框架AttnRL,引入注意力机制提升过程监督强化学习效率与性能。它解决传统方法在分支位置选择和采样策略上的效率问题,实验显示在多基准测试中表现优异。
独家丨滴滴悄咪咪上线了个「AI 图寻」产品
2013 年 GeoGuessr 地理猜测游戏走红,衍生出「图寻」玩法。2024 年 AI 让“猜地点”能力大增。今年滴滴悄悄上线 AI 图寻产品「在哪儿问问」,具实用工具属性,但 AI 识图在冷门场景表现欠佳。
可能是目前效果最好的开源生图模型,混元生图3.0来了
腾讯混元发布并开源原生多模态生图模型混元图像3.0,参数规模80B,是参数量最大的开源生图模型,也是首个开源工业级原生多模态生图模型,效果对标业界头部闭源模型。文中介绍其技术方案、测评效果等。
黄仁勋出手!45倍性能暴涨,英伟达定义物理AI新纪元
在SIGGRAPH 2025上,英伟达发布「物理AI」全家桶。展示完整生态,含新硬件、仿真平台和AI模型。如RTX PRO 6000服务器显卡性能涨45倍,还推多款模型,应用于多领域,推动物理AI落地。
狂肝一周,测评十余款 PPT AI 生成产品的真实反馈
评估 Agent 产品能力复杂,以 PPT 生成为例,有 Agent 和模板化两种流派。作者选前者投票测评、后者全方位测试。给出方案,还推荐不同需求适用产品,附总榜单和细致体验描述。
OpenAI谷歌Anthropic罕见联手发研究!Ilya/Hinton/Bengio带头支持,共推CoT监测方案
OpenAI、谷歌DeepMind、Anthropic联合发表立场文件,提出CoT监测概念,认为是控制AI Agent核心方法。探讨其潜在机遇、局限,还提及不同公司对CoT监测的不同态度,如OpenAI乐观,Anthropic焦虑。
开源多模态大模型EarthMind,观测地球统一框架
地球观测数据复杂,现有多模态模型难适用。意大利、德国多所高校研究人员联合开源多模态大模型EarthMind,引入空间注意力提示模块,实现跨模态融合和多粒度理解,解决地球观测难题。