「开源语音模型」共找到 9101 篇相关文章
从局部最优到全局跃迁:关于企业“智慧运营中枢”模式的构建与实践思考
文章阐述企业数智化转型历程,指出转型中战略脱节、业技融合难等问题,介绍以企业架构为核心构建的“智慧运营中枢”模式,主张用大模型重塑业务价值链,强调转型是长期变革。
为什么AI总是"记错"你?我们造了一个"合成人生"来测试
现有AI记忆评测只记'事'不记'人',存在数据源窄、不重理解、注入成本高的问题。QuantaAlpha联合高校团队提出CloneMem基准测试,用'数字痕迹'评估AI Clone长期记忆能力,实验有反直觉结论并给出设计启示。
SmartSearch:奖励驱动query精炼,让Agent中的RAG会“改错”
现有LLM搜索Agent忽视‘如何提问’致答案易出错。SmartSearch提出‘过程奖励+查询精炼’双机制,让Agent学会‘写不好就改’,代码已开源。经实验,它在六数据集全面领先,各机制缺一不可。
硅谷AI战火烧进医院!终于可以告别「天书」化验单了
OpenAI和Anthropic的战火燃至医疗领域,OpenAI发布ChatGPT健康,Anthropic推出医疗健康版Claude,还打通数据壁垒,提供个性化健康解答。其还在提升模型能力,保障隐私安全,且各有应用场景。
“心内推理”:一种动态多模态潜在空间推理范式 | 直播预约
当前多模态大模型推理效率低、稳定性不足。本次分享将介绍DMLR,它无需额外训练,仅在推理阶段生效,通过在潜空间优化潜在思考token、引入关键视觉信息,实现高效稳定的多模态推理。
GAG:超越RAG,无需检索的私有知识注入新范式
在高价值私有场景,主流大模型注入知识的路线各有硬伤。中科院和360AI联合团队提出GAG方案,无需检索、固定底座、单Token、即插即用,实验显示效果佳,也指出跨域组合等局限。
Agent上下文工程被Cursor玩出了新高度~
Cursor的agent为所有模型使用动态上下文,在保持质量时更智能填充上下文。代码Agent改变软件开发方式,Cursor提出动态上下文发现模式,介绍了在其中使用该模式的做法及优势。
马斯克xAI又融了200亿美元!老黄说到做到投了更多
刚开年,马斯克的xAI完成E轮融资,达200亿美元超预期。英伟达和思科等继续支持,其估值预计从500亿涨至2000多亿。还公布《xAI 2025年终总结》,Grok 5正在训练,传闻一季度推出。
太魔幻了!刚刚OpenAI发布GPT Image 1.5:Nano Banana Pro 王座不保
OpenAI发布由GPT Image 1.5驱动的新版ChatGPT Images。新模型核心升级体现在精准修图、指令遵循能力强、生成速度提升4倍。还推出Images主页,API上线且价格降20%,适合企业。
我如何用低代码平台复刻NotebookLM体验:从文档到可控PPT生成,全流程实战。
本文作者用低代码平台BISHENG复刻NotebookLM的PPT生成功能。介绍了技术栈,详述工作流搭建,包括文档上传、问答、PPT生成等,还提及HITL机制提升成功率,最后总结了低代码平台的优势与不足。