「第一视角交互」共找到 1075 篇相关文章
让小爱音箱超越「指令-响应」模式,开启真正智能交互新时代
2017年智能音箱诞生,却被困于「指令 - 响应」模式。此次Open - XiaoAI进化,接管小爱音箱“耳朵”和“嘴巴”,通过多模态大模型和AI Agent释放其潜力,还给出项目运行教程等。
BrowseComp等评测集第一,秘塔推出「深度研究」,已开启免费公开访问
世界变化快,AI领域新概念不断。秘塔在上线“浅度研究”五个月后,将其升级为“深度研究”。该模块最初由OpenAI推出,秘塔版可免费公开访问,准确率优,还让研究过程可见。
画质重生,第一!腾讯TEG香农实验室斩获CVPR 2025 UGC Video Enhancement 冠军
CVPR NTIRE是计算机图像恢复与增强领域有影响力的赛事。在NTIRE 2025 UGC Video Enhancement中,腾讯TEG香农实验室团队自研算法夺冠,成果落地提升视频清晰度。团队还参加实时赛道获佳绩,且做了硬件推理优化。
OpenAI曝出第一颗芯片叫「辣椒」!AI自己设计,9个月流片
OpenAI首颗自研芯片Jalapeño问世,9个月从白纸到流片,创行业最快纪录。该芯片专为大模型推理设计,由其AI参与设计优化,有望降低推理成本,提升用户体验。OpenAI欲做全栈AI公司。
6.1B激活,三榜开源第一!蚂蚁·安诊儿医疗大模型发布
由浙江省卫生健康信息中心等联合研发的开源医疗语言模型AntAngelMed发布。它基于Ling - flash - 2.0,100B总参数仅激活6.1B达约40B密集模型性能,在多个权威医疗基准测评中居前列,采用三阶段训练流程,高效MoE架构。
全球电池回收技术爆发:中国专利断层式领先,宁德时代子公司排第一
欧洲专利局和国际能源署报告显示,全球电池回收技术创新爆发,循环利用专利增长快。中国在该领域表现突出,宁德时代子公司邦普循环专利领先,且中国掌控矿产精炼与回收两端,不过全球面临缺料挑战。
全球AI双榜第一!力压谷歌Veo与Grok,Vidu Q3「参考生」之王归来
这个月初谷歌免费开放Veo 3.1视频生成能力,让AI视频更普及,但模型距‘能交付’仍有差距。Vidu Q3带着‘全家桶’回归,覆盖多领域,在权威评测榜单成绩优异,视觉、听觉和场景能力升级。
马斯克「脑机第一人」首爆!不开颅在线升级,永生代码已写入
Neuralink首位人类受试者Noland Arbaugh自曝大脑芯片更新方式和特斯拉类似,可在线升级。如今奥特曼入局,其参与创立的Merge Labs获2.52亿美金种子轮融资,要做更大规模脑机接口。
深度解析世界模型:新范式的路线之争,实时交互与物理仿真
文章认为2026年多模态技术将有大发展,世界模型轮廓渐清。文中对比语言、视频生成模型,指出世界模型优势,分析实时视频与3D结构化两条路线,介绍不同公司产品并以四象限框架分类。
马斯克Grok 4.1双冠封王,爆冲第一!AI王座一夜易主
马斯克携xAI推出Grok 4.1并免费开放。它在LMArena和EQ - Bench登顶,写作Elo提升600分、幻觉率降3倍。后训练RL规模扩大,还经盲测评估,在多方面表现出色。