「控制面设计」共找到 2070 篇相关文章
最新W4A4KV4全量化框架,单卡A100大模型推理速度飙升
计算所王颖研究员团队等联合在ASPLOS 2025上发表并开源COMET框架,通过系统 - 算法协同优化,实现全4比特推理性能突破,在多方面有技术亮点,实测性能碾压现有方案且已开源。
又来一款 AI 编程远控项目,有点意思!
GitHub上出现开源项目`HAPI`,它是本地优先的AI编程远程控制工具,可让用户在手机或平板远程接管Claude Code等AI助手会话,有无缝切换等特性,安装简单,值得开发者体验。
基础模型又一关键拼图,腾讯混元发布训练新范式「无相」:引入功能性记忆,打破静态权重枷锁
腾讯混元团队发布HY - WU范式,打破静态权重束缚,引入功能性记忆,实时生成个性化参数。应用于图形编辑基模效果好,在图像编辑任务表现优秀,还对未来AI架构提出多方面展望。
教程 | 如何做出 X 上爆火的 AI 蓝图动画
作者受X上爆火的Midjourney风格代码启发,分享恐龙主题短片制作方法。介绍风格代码功能,还讲了控制画面配色技巧,最后给出复杂动画prompt示例,推荐找风格代码的作者和网站。
突破显存瓶颈:基于 DeepSeek-V3.2-Exp 的 Latent Cache 卸载预取方案设计与模拟验证
百度百舸AIAK团队针对DeepSeek-V3.2-Exp,设计基于Latent Cache的卸载预取方案ESS。该方案解决显存瓶颈,提升Decode吞吐并降低成本,经模拟验证效果显著,未来将拓展应用。
APP 上线 40 天后,Sora 核心团队分享了他们对于 AI 社交的关键思考
Sora APP上线不到5天下载达100万次,近200万周活用户中70%在创作。其核心团队分享对AI社交思考,介绍玩法、设计理念,还谈及推荐算法、创作门槛、商业化等方面规划。
2.4K Star!小米最新开源!覆盖600+语种的语音克隆TTS,40倍实时合成速度!
小米k2 - fsa团队开源OmniVoice,这是支持600 + 语种的零样本语音克隆TTS模型,性能超ElevenLabs v2和MiniMax等标杆,RTF低至0.025,合成速度快40倍,还支持声音设计等功能。
ICLR 2026 oral | AI代码真能进生产环境?SwingArena:从「写对代码Commit」到「通过CI审查」
过去一年大模型写代码能力提升,人们思考其能否参与软件工程核心流程。现有评测基准有缺失,SwingArena填补空白,将博弈引入评测,设计检索增强流水线,其开源后或成评估AI编程能力新工具。
港大nanobot4,000行代码复刻Clawdbot
港大nanobot用4000行代码复刻Clawdbot,解决AI从‘被动回答’到‘主动服务’问题。它有核心架构Agent Loop,三大主动触发机制,模块化设计,还坚持少即是多原则,让AI成自动化助手。
MIT成果登Nature正刊:90天,「AI科学家」完成3500次电化学测试
美国麻省理工学院李巨团队在Nature发表论文,展示多模态机器人平台CRESt。它结合多模态模型驱动的材料设计与高通量自动化实验,大幅提升催化剂研发速度和质量,还解决了实验结果可重复性不足问题。