「技术问题」共找到 5568 篇相关文章
完全透明开源的共情语音大模型,三阶段训练,四大模块实现端到端对话 | 紫东太初联合长城汽车开源OpenS2S
GPT - 4o、Gemini等顶级语音模型闭源,紫东太初团队联合长城汽车AI Lab开源端到端共情语音语言大模型OpenS2S,提供构建共情语音系统新范式,开源所有核心资源,还介绍了技术方案、数据构建及训练流程等。
扒光谷歌Gemini 2.5:一份官方“翻车报告”,揭露AI Agent的8个秘密。
谷歌DeepMind发布Gemini 2.5技术报告,以玩《宝可梦 红/蓝》为例,展示构建有效智能体的案例。该系统架构由多部分组成,但运行状况百出,如上下文过长变差、产生幻觉等,也有亮点,还能提炼避坑方法。
苹果提出原生多模态Scaling Law!早融合+MoE,性能飙升秘密武器
如今打造强大多模态模型是AI重要目标,常用方法有局限。法国索邦大学、苹果研究人员开展原生多模态Scaling Laws研究,对比早融合与后融合,探讨多种因素对模型性能影响,发现早融合、多模态MoE优势,为后续研究指明方向。
Reasoning的最终答案可能不是模型想要的答案!
大型语言模型解决复杂问题有推理过程和答案,传统评估只看最终答案。论文提出最终答案可能不佳,中间步骤更值得研究。还介绍通过切割推理过程发现中间步骤藏玄机,提出‘分步检查法’提升模型表现,实验表明准确率最高提升13%等。
直击2026骁龙峰会:2nm旗舰首秀,但Agent正在重塑骁龙|甲子光年
本文是甲子光年发自2026高通骁龙峰会的现场报道,高通发布全球首款2nm工艺旗舰移动平台,同时披露其面向Agentic AI重构芯片架构、布局跨终端AI计算底座的完整战略,深度分析了端侧Agent落地的技术挑战与生态进展。
“当年在OpenAI像在疯人院!”Jev作者完整访谈:全人类陪AI聊天的价值,不如程序员一个for循环
本文整理了前OpenAI核心研究员、Jev模型创始人Diogo Almeida的完整访谈,Diogo批判当前行业all in聊天大模型的路径偏差,推出专为程序决策设计、不做聊天交互的Jev模型,提出全新RLCD技术范式,倡导AI作为软件底层基础设施赋能自动化生产力。
这个新生图模型有点夯:4K直出的,国产的,开源的!
商汤新开源的生图模型SenseNova U1.5-Lite-Preview亮点十足,它是国产、4K直出、轻量且可指哪儿改哪儿的原生统一多模态模型。能应对复杂创作和编辑任务,技术源于NEO-Unify架构,评测成绩佳,不过还是早期预览版。
去了一趟中国AI实验室,Linux基金会CTO感叹:西方那两套偏见全破产了
Linux 基金会全球 AI 技术官 Matt White 访华后称,西方对中国 AI 的偏见破产。中国实验室文化黏性强、人才回流,工具反向输出美国。他指出西方出口管制未卡死中国,还让其成自研芯片‘卷王’,开源模型也更受青睐。
做 AI 产品,最重要的是尊重常识
2026年3月滴滴上线AI出行助手「小滴」,6月支付宝测试AI版「阿宝」,看似先进,但实际存在问题。滴滴将基础目标包装成AI个性化,支付宝承诺办事却像找路,还不敢让AI碰钱。很多AI产品迷信聊天框,未带来体验升级。
九章云极发布AI工厂体系:破解140万亿Token时代的落地悖论|甲子光年
九章云极于6月17日发布Alaya NeW AI工厂体系,锚定十万P算力、十万亿Token、千个模型、千倍降本四大目标。该体系是智能工业化的必然产物,能解决资源难转生产力的难题,还具备技术效能、生态范式和商业飞轮三大支柱。