「开源TTS工具」共找到 4396 篇相关文章
Kimi K2 详测|超强代码和Agent 能力!内附Claude Code邪修教程
作者熬夜带来 Kimi K2 模型详测及 CC+K2 邪修教程。K2 是 1T 参数量的 MoE 开源模型,基准测试成绩优异,在代码、Agent、数学推理任务表现突出,前端能力强,还能驱动 Claude Code,成本低。
【医学影像分割】UN-SAM:一种高效且通用的细胞核分割模型
文章提出UN - SAM框架解决现有SAM在医学影像分割依赖人工标注、跨域泛化不足问题。它含三大模块,能自动生成提示、增强特征判别力和跨域分割精度,实验显示其在多数据集表现优,代码已开源。
Agent RL和智能体自我进化的关键一步: TaskCraft实现复杂智能体任务的自动生成
当前智能体训练缺高质量任务数据,主流数据集依赖人工标注,规模和复杂性受限。OPPO 研究院提出 TaskCraft 框架,能自动生成智能体任务,构建并开源含约 41,000 条任务的数据集,支撑智能体训练评估。
Chimer AI 黄祯:自然而然地干了离经叛道的事 | 00 后创业者系列
本文是对 00 后创业者黄祯的访谈。他大学休学创业,先尝试珠宝等行业,后聚焦服装产业。起初做 SaaS 工具,因国内市场不佳转向 Agent 与 SaaS 结合,还获吴世春融资,分享了创业经历、思路及产品特点。
揭开大模型“伪遗忘”,港理工等团队:结构不变就是没忘
近年来大语言模型隐私风险受关注,机器遗忘技术应运而生。港理工等团队构建表示空间诊断工具,区分‘可逆性遗忘’与‘不可逆遗忘’,揭示遗忘现象背后表示结构变化规律,还做了相关实验并得出核心结论。
阿里通义开源「推理+搜索」预训练新框架:小模型媲美大模型,多个开放域问答数据集表现显著提升
阿里通义实验室开源通用预训练框架MaskSearch,引入检索增强型掩码预测任务,兼容两种训练方法。实验显示,它在多数据集提升模型性能,小模型能媲美大模型,还验证了训练方式、策略及奖励函数的效果。
超越DeepSeek-R1,英伟达开源新王登顶!14万H100小时训练细节全曝光
英伟达Llama - Nemotron系列模型超越DeepSeek - R1且全部开源。论文揭秘其训练关键,如用合成数据监督微调与强化学习等。还介绍构建阶段、架构设计等,评估显示该系列模型在多任务表现出色。
又一家AI基金暴雷了
7月AI抛售潮来袭,鲸岩资本等AI基金损失惨重,如鲸岩资本7月暴跌21.7%,亏光半年收益。这背后是AI基建落地慢回报少,且国产开源模型冲击,让投资者质疑此前的AI投资。
翻译:代码日趋廉价,软件依然昂贵
Claude Code等大语言模型工具强大,让软件构建门槛崩塌,迎来个人化软件时代。但构建有价值软件门槛仍高,代码虽廉价,软件维护等成本贵。工程师价值转向系统架构,真正挑战是分发和分辨实用价值。
3B Image Captioning小钢炮重磅来袭,性能比肩Qwen2.5-VL-72B
文章推荐Dense Image Captioning新技术CapRL,它首次将DeepSeek - R1强化学习法用于image captioning,创新定义reward。训练的CapRL - 3B模型性能比肩Qwen2.5 - VL - 72B,解决了reward设计难题,已开源相关内容。