「流数据入湖」共找到 2880 篇相关文章
ACL 2025|为什么你设计的 Prompt 会成功?新理论揭示大模型 Prompt 设计的奥秘与效能
英属哥伦比亚大学等团队剖析Prompt在LLM的CoT推理中调控模型内部信息流,构建量化Prompt搜索空间复杂度理论框架。研究解释提示有效的原因,提供设计高效提示词思路,实验验证理论框架。
没想到,最Open的开源新模型,来自小红书
向来低调的小红书昨日开源首个自研大模型 dots.llm1,它是中等规模的 MoE 模型,在较小激活量下性能良好。其开源力度堪称行业最大,还介绍了数据处理、训练优化等多方面技术细节。
效果逼真到让人窒息!开源Ctrl-Crash模拟车辆事故
近年来视频扩散技术在生成车辆碰撞真实场景时面临挑战,因驾驶数据集中事故样本稀缺。Mila团队提出Ctrl - Crash可控碰撞视频生成模型,支持反事实场景生成,但也存在一些局限。
辛顿、杨立昆等 AI 先驱都源自信号处理——对话 IEEE 首位华人主席、美国双院院士刘国瑞 | 万有引力
本文是对IEEE首位华人主席刘国瑞的访谈。他分享了科研、创业经历,谈到AI先驱多源自信号处理,鼓励年轻人追梦,还探讨了科研模式、合成数据、AI应用及未来生活图景等话题。
AI数学能力暴涨100%,自进化直逼RL极限!CMU新作颠覆认知
数据枯竭成AI发展瓶颈,CMU团队提出SRT方法,让LLM自我进化,提升数学与推理能力,性能逼近传统强化学习。研究还分析其局限,提出缓解奖励作弊策略及应对模型崩溃的方法。
Memvid:把你的文档库变成一个小巧的视频,还能瞬间搜出你想要的!
传统向量数据库因高成本和复杂运维让开发者却步。开源项目Memvid将文本数据存入视频文件,能高效检索,解决存储冗余、检索延迟和网络依赖问题,使用简单,虽处概念原型阶段但值得尝试。
MCP Server的五种主流架构与Nacos的选择
文章剖析MCP Server五种主流架构模式,结合Nacos服务治理框架,为企业级MCP部署提供指南。介绍各架构优缺点与适用场景,展示Nacos赋能及实战集成,还给出架构选型指南。
完全开源的7B模型,性能比肩主流LLM,训练成本仅16万美元,复现DeepSeek的强化学习!
Moxin-7B由多机构团队联合开发,遵循“开源科学”原则,公开全流程细节。它训练成本仅16万美元,评测表现亮眼,在架构、数据策略、训练过程等方面有创新,为中小企业提供可控AI方案。
每周产业洞察|校园母题与流量要素成为AI短剧行业的爆款公式
近期AI短剧行业数据亮眼,TikTok生态和国内市场规模惊人,但淘汰率也高。其有“校园母题+流量要素”爆款公式,AI降低制作成本,工具平台参与度加深,且用户画像向男性、游戏用户迁移。
鸿蒙元服务的“体验密码” | 从京东到深圳万象城,看技术底层如何让服务直达用户
AI时代,系统能感知用户场景与需求,主动推送服务。鸿蒙元服务解决用户体验痛点,其技术底座帮开发者“减负”。如京东复用代码,深圳万象城优化停车服务,还为中小商户提供零代码开发方案。