「产学研结合」共找到 794 篇相关文章
锁定角色,「多主体」也可控!个性化文生图,给你PS般交互体验
LayerComposer革新个性化图像生成,能让用户如在Photoshop般操控元素位置、大小,解决传统方法交互性与多主体扩展难题。它有分层画布、锁定机制、模型–数据共设计三大特点,实验表现出色,未来将促进人机协同创作。
基于DINOv2和SAM2改进的U-Net模型
DSU-Net是基于DINOv2和SAM2改进的U-Net模型,通过多尺度跨模型特征协作和轻量级适配器模块,解决现有图像分割模型在特定下游任务表现不足问题,提升分割精度,降低训练成本。
面壁小钢炮 VoxCPM-TTS:开源端到端 TTS,轻量高效低延迟
面壁提出基于扩散自回归建模的端到端语音生成模型 VoxCPM,构建于 MiniCPM - 4 之上。它克服传统离散 token 方法缺陷,实现语义与声学特征解耦,有上下文感知语音生成和零样本语音克隆能力,低延迟。
空间智能新高度:港科大谭平团队SAIL-Recon突破万帧级图像大规模3D场景重建Transformer
香港科技大学谭平教授团队与地平线团队发布3D场景表征与大规模重建新方法SAIL - Recon,突破现有模型处理能力瓶颈,可实现万帧级场景表征抽取与定位重建,在多数据集上表现优于现有方法。
Pinterest 在迁移到 Kubernetes 的过程中发现了罕见的搜索失败
Pinterest 工程师披露将搜索基础设施迁移到 Kubernetes 时遇‘百万分之一’故障调试过程。故障由容器化组件与遗留设施过渡时细微不一致触发,该事件凸显云原生迁移挑战及调试价值。
OpenAI官方GPT-5 提示词泄露:这套“反向Prompt”技巧,让模型听话得像条狗。
GPT5提示词被破解,结合官方《GPT - 5 Prompting Guide》有不少技巧。如Metaprompting让GPT - 5优化Prompt,指导AI编码可明确知识、培养自信等,还有控制AI主动性的方法。
ScreenCoder:视觉-代码对齐新范式,为多模态程序合成开辟道路
前端开发中UI转代码耗时易错,现有工具存在不足。ScreenCoder提出模块化多智能体框架,通过三阶段分工协作实现代码生成,还构建数据引擎推动VLMs进化,实验表现出色,为多模态程序合成开辟道路。
Cursor 0.50 版本升级后如何省钱又高效?一份给开发者的避坑指南
本文围绕Cursor编程助手日常应用展开,讲解计费机制、工具调用等核心要点,结合实践给出高效使用方法论与避坑指南,如合理选模型、巧用工具、设置规则等。
不用抗生素也能抗菌!AI设计新型蛋白质抵御细菌耐药性|Nature子刊
澳大利亚研究借助AI工具设计出能与ChuA结合的蛋白质,抑制大肠杆菌等细菌生长。这些蛋白质像“分子锁”,阻断细菌获取血红素,降低耐药风险,开创“非抗生素”抗菌新范式。
一篇Graph+AI Agents最新技术综述
该综述提出分类框架组织Graph与AI Agents领域研究进展,详细探讨图技术在AI代理规划、执行、记忆和多代理协调等核心功能中的作用,还提及代表性应用、挑战和未来机遇。