「算法题目生成」共找到 2726 篇相关文章
这张信息图,居然是8B开源模型做的??
商汤新开源的 8B 多模态模型 SenseNova U1,架构独特,图像评测表现好,信息图生成能力强、延迟低。它具备图文交错能力,适合自媒体、敏感行业等,有在线体验和开源代码入口。
干掉延迟!12G显存就能实现实时AI换脸直播,开源免费。
推荐开源项目PersonaLive,它是基于自回归流式扩散技术的实时人像动画生成框架。能平衡画质与低延迟,用一张照片在普通显卡实现数字分身实时驱动,有低显存、无限时长等特点。
哈佛发现基础模型比你想象中更强大:纯采样方法可超越RL
论文提出基础模型本身已具备强大推理能力,通过“幂采样”纯采样算法,在多推理任务上媲美或超越RL后训练,挑战“RL才能提升推理”观念,为理解基础模型潜力开新视角。
让RAG告别断章取义,HiChunk做到了~
现有RAG评测忽视文档切分,腾讯优图提出HiCBench评测基准和HiChunk框架。HiCBench含人工标注多级切分点与证据稠密QA,HiChunk用微调LLM建多级语义树,配Auto - Merge算法,实验效果佳。
行业新突破:行为基础模型可实现高效的人形机器人全身控制
该综述聚焦行为基础模型(BFM)在人形机器人全身控制中的应用,梳理进展并分类算法,介绍应用与限制,还探讨未来研究机会与风险,有望引导该领域研究者和从业者。
直播预约 | 强化学习训练能否不依赖外部知识优化模型的弱点?
论文提出 SwS 框架,针对强化学习场景,利用模型自我感知弱点驱动自动化问题生成,合成针对性训练数据。还对其进行多项扩展,在多个基准测试集和模型上验证有效,性能提升显著。
别再手搓测试数据了!AE测试数据智造系统揭秘
本文介绍基于大语言模型的AE测试数据智造Agent,解决AliExpress跨境电商测试数据构造难题。它结合大模型与原子工具库,实现自然语言驱动的全链路测试数据生成,提升测试效率与智能化水平。
LeCun 两连推!LeJEPA 核心作者最新论文,改写 JEPA 表征坍塌困局
社交平台X上,研究工作VISReg获图灵奖得主Yann LeCun两连推。它精准命中JEPA世界模型核心痛点——表征坍塌,不靠“外挂”、仅用1/10数据,就在15个数据集上力压7大主流自监督学习算法。
谷歌TurboQuant会绕过“内存墙”?这个判断有点过了|甲子光年
谷歌发布的TurboQuant论文引发市场震动,其算法可将大语言模型推理的KV缓存大幅压缩并加速。但将其视为绕过‘内存墙’判断过度,它提升单位字节信息密度,改变边际需求曲线,代表范式转移。
港大刚刚开源了 CLI-Anything!一个命令让任意软件秒变 AI Agent 原生工具!
香港大学数据科学实验室团队开源 CLI - Anything,它以 CLI 为桥梁,将人类软件转变为 Agent 能用的工具。该项目有一键生成 CLI、真实软件集成等亮点,还给出快速入手步骤和使用示例,未来规划宏大。