「后训练方案」共找到 4421 篇相关文章
TRAE SOLO 模式中国版惊艳上线,重新定义 AI 编程
字节 TRAE 推出 SOLO 模式解决复杂编程任务难题,11 月 25 日国内版上线且免费。它体验增强,集成 SOLO Coder,有执行前方案评审等四个关键能力,带来新协作模式,提升编程效率。
这款开源AI卡片笔记,让我果断卸载了Obsidian!
开源君推荐开源项目Blinko,它是自托管、AI驱动的个人笔记工具,主打“快”与“智能”,将RAG技术和LLM能力融入笔记管理,数据自主可控,适合注重数据安全和知识管理的人。
华为诺亚发布ScaleNet:模型放大通用新范式
华为诺亚方舟实验室等团队提出 ScaleNet 方法,创新性地用少量额外参数量将模型深度扩展一倍。结合层级权重共享和轻量级适配器技术,在视觉和语言任务上验证了有效性,提升了模型性能。
52个人用AI做PPT,年赚7个亿
在2025年,硅谷AI公司多“烧钱换增长”,Gamma却靠一款AI PPT工具,52人年入上亿美元,估值达21亿美元。它曾遇困境,后借AI逆袭,还分享独特运营哲学。
Voices 能够让 Java 应用程序快速实现文本到语音转换
Voices 是开源文本转语音项目,为 Java 17 及以上应用设计,无需外部 API 或手动安装软件。可按字典或 OpenVoice 为不同语言生成音频,其使用 ONNX Runtime 加速,还介绍了使用方法和配置。
MeshCoder:以大语言模型驱动,从点云到可编辑结构化物体代码的革新
生成式AI在三维空间面临挑战,传统3D生成成果粗糙难编辑。团队推出MeshCoder,将三维输入翻译成结构化代码,有分部件生成等优势。介绍其实现路径、实验性能,也指出局限并展望未来。
AGI 新技术路线:下一代稀疏注意力机制 Monte Carlo Attention 开源
超对称技术公司在新版基座模型 BigBang - Proton 中使用的 Monte Carlo 注意力开源。它基于二进制块编码技术,用块间代表交流机制实现线性复杂度,兼具多种注意力机制优点,可满足宇宙尺度建模的上下文长度需求。
Hugging Face 推出 GOLD:让不同模型家族也能做知识蒸馏
Hugging Face研究团队提出GOLD方法,解决了知识蒸馏中老师和学生模型需用同一套分词器的痛点,让不同模型家族间也能做知识蒸馏。它通过三步解决跨分词器蒸馏,实验效果良好,已集成到TRL库。
ICCV 2025 | 港科、牛津大学发布AlignGuard,文图生成模型可规模化安全对齐框架
随着文图生成模型广泛应用,其安全防护机制有限。ICCV 2025上,港科、牛津大学推出AlignGuard,是文图生成模型可规模化安全对齐框架,通过生成CoProV2数据集等实现安全对齐,实验效果佳。
AI时代,为什么你又焦虑又学不进去?这个人破解了专注力的秘密
文章指出AI时代人们学不进去,原因在于信息爆炸、AI工具易致分心,本质是没学会处理学习不适。介绍了Time Boxing、“10分钟法则”等应对方法,强调专注力是新学习力,要预先规划建立学习系统。