「零技术背景」共找到 3200 篇相关文章
没想到,音频大模型开源最彻底的,居然是小红书
近几个月,开源成AI社区焦点,国内厂商七八月开源多款大模型,但音频生成占比小。小红书技术团队自去年起在音频领域稳定开源,成果覆盖TTS、ASR方向,具商用属性,降低落地门槛。
对话RoboScience邵林:VLOA大模型如何突破具身智能泛化瓶颈
本文对话RoboScience联合创始人邵林,探讨VLOA大模型突破具身智能泛化瓶颈。他介绍了模型优势、设计思路,对比VLA,还谈及范式、难点及落地场景等,强调以人中心、做有温度技术,重视模型落地。
CES 2026超前瞻:空间智能来势汹汹!从实验室奢侈品到消费级刚需,如何重塑 AI 具身时代?
2026年CES展上,空间智能从学术概念迈向产业实践。当前具身智能存在‘语言强、手脚笨’困境,空间智能是破解关键。全球分世界生成与空间决策两条技术路径,且行业正迎来成本降低的拐点。
AST | 西交大刘子扬、陈刚等:直接嵌入流场特征的智能化气动外形优化经验学习框架
传统气动外形优化方法有局限,本文提出智能化优化经验学习框架,结合DNN流场预测模型与DRL优化方法,还提出自适应网格再生成技术与Sigmoid奖赏函数,经验证效果良好,为气动优化提供新路径。
Kafka 网络成本失控?如何彻底根除 AWS、GCP 上的 Kafka 网络隐性成本
云原生架构普及,企业将 Apache Kafka 部署到 AWS、GCP 等公有云,跨可用区数据传输成本成“隐形杀手”。AutoMQ 是新一代云原生 Kafka,100% 兼容 Kafka 协议,其“零成本复制”技术可降本,已在 GitHub 开源。
用嘴聊出来了一个 APP:实测「码上飞」语音开发有多离谱
本文实测「码上飞」AI 开发平台,它让用户用对话或语音描述需求,AI 就能做出应用。测试了美甲预约、AI 生图、私域自媒体知识付费小程序三个场景,它表现出色,大幅压缩开发成本,助普通人跨过技术门槛。
Meta发布Omnilingual ASR:支持1600+语言的开源语音识别系统
Meta发布全新自动语音识别系统Omnilingual ASR,支持超1600种语言,核心创新是零样本和少样本学习能力,降低小语种语音识别门槛。项目提供不同规模模型,安装调用简单,目前仅支持40秒内音频,数据集和项目均开源。
AI领域全新热门职业,岗位需求今年已增长逾800%
在AI技术飞速发展当下,「驻场交付工程师」(FDE)成连接实验室与市场关键角色。他们兼具算法能力与业务洞察,深入客户现场将抽象模型转化为可落地解决方案。国外企业纷纷扩充FDE团队,国内也开始有类似趋势。
中国游戏行业:产业结构、薪酬体系与核心人才需求分析
文章分析中国游戏行业,指出其已成为复杂数字经济体,2024年市场收入稳健增长。发展历经多阶段,AIGC等技术带来变革。商业模式以F2P与内购为主,“研运一体”是关键。行业薪酬有竞争力但工作强度高,版号影响深远。
AI 引领的企业级智能分析架构演进与行业实践
在 QCon 全球软件开发大会(北京站)上,数势科技 AI 负责人李飞分享了企业级智能分析架构演进与实践。探讨了智能分析落地问题,介绍 Agent 结合数据分析优势、技术路线及落地要点,还对 Agent 发展给出思考与展望。