「场景化芯片创新」共找到 3243 篇相关文章
科大讯飞研发总监王磊磊将在 AICon 上海分享多模态降噪技术的实践与应用
5月23 - 24日AICon上海大会将聚焦AI前沿与产业落地。科大讯飞王磊磊将分享《复杂场景下的语音交互,多模态降噪技术的实践与应用》,介绍基于多模态融合的降噪技术体系及其在智能硬件中的应用。
DiffMoE:动态Token选择助力扩散模型性能飞跃,快手&清华团队打造视觉生成新标杆!
清华大学和快手可灵团队推出DiffMoE,通过创新的动态token选择机制和全局token池设计,拓展了扩散模型的效率与性能边界。实验表明,DiffMoE在多方面超越现有模型,未来集成先进技术或有新增益。
超低延迟的端到端语音模型!首次生成音频仅需53ms,比同级别模型快3-5倍!
随着语音应用场景普及,语音大模型响应慢成瓶颈。VITA团队开源端到端语音模型VITA - Audio,7B参数模型首次生成音频仅53毫秒,比同级别快3 - 5倍,完全开源,有超低延迟等优势。
DeepSeek发布最新论文,5大杀手锏让大模型训练、推理暴涨
全球著名开源大模型平台DeepSeek在huggingface发布超强开源模型V3的论文,从硬件架构和模型设计双视角探讨高效训练和推理,提出DeepSeek - MoE、多头潜在注意力等创新技术,解决内存、计算效率等难题。
浙大 × 字节 × 港中深最新研究:告别高斯堆砌,终结 3D 冗余|ECCV 2026
本文解读浙大、字节跳动、香港中文大学(深圳)联合收录于ECCV 2026的PointSplat研究,针对3D高斯溅射的跨视角冗余问题,提出以人为中心的新框架,解决3D表示体积过大问题,适配实时场景。
Gemini 3.8,明日登场!
最新爆料,Gemini 3.8 Flash明日登场,谷歌已放弃Gemini 3.5 Pro。其编程实力强悍,之前还为Gemini植入智能体视频理解功能,降本提效,可应对多种高难度场景。近期多家AI发布计划撞车,混战升级。
王田苗三问具身大牛:大模型还在「拨号上网」,机器人靠什么拿下真实订单?| WRC 2026
在2026世界机器人大会的圆桌论坛上,王田苗向具身智能头部企业CXO抛出尖锐问题。嘉宾围绕量产卡点、大模型应对物理世界不确定性及产业终局生态展开讨论,并就商业化落地节奏达成共识。
比 Playwright 更给力,这个新开源的项目6啊~
GitHub上的BrowserAct项目是面向AI Agent的浏览器自动化CLI,是为AI Agent设计的真实浏览器执行层。它有三层反检测突破体系、三种浏览器模式等功能,能解决Agent操作浏览器的诸多问题,适合多场景。
Claude不到4%,全军覆没!一场大考撕碎Agent「全自动办公」幻想
新智元报道,UniPat AI的SaaS - Bench实战考卷,用23个真系统、106个任务测试Agent。结果显示,Claude Opus 4.7完全通过分数仅3.8%,多数模型全军覆没,暴露了Agent在真实环境中的四种致命缺陷。
长鑫科技,哪里值钱?
长鑫科技是国内最大DRAM芯片制造企业,过去十年累计亏损超366亿。2026年一季度,其营收508亿,归母净利润247.62亿,填平九年亏空。分析其利润可持续性,需从供需、产能、毛利率、HBM等维度判断。