「产品能力」共找到 4566 篇相关文章
多模态大语言模型的核心技术架构与训练方法的进化
文章深入剖析多模态大语言模型核心技术架构与训练方法的进化,涵盖建模范式、视觉编码器、语言骨干网络、模态对齐、生成范式及训练方法等方面,介绍其演进路径与代表模型,还提及国内模型创新及开源模型OpenVLA。
字节阿里DeepSeek决战春节:一场关乎14亿人的重磅AI大战
春节将至,字节、阿里和DeepSeek间的AI大战拉开帷幕。字节将推三款多模态旗舰模型;阿里或发布Qwen 3.5,让千问打通支付与电商;DeepSeek V4或携强代码能力突袭。这是对用户生活入口和互联网秩序的争夺。
为什么AI总是"记错"你?我们造了一个"合成人生"来测试
现有AI记忆评测只记'事'不记'人',存在数据源窄、不重理解、注入成本高的问题。QuantaAlpha联合高校团队提出CloneMem基准测试,用'数字痕迹'评估AI Clone长期记忆能力,实验有反直觉结论并给出设计启示。
社区供稿丨Jina-VLM:可在笔记本上跑的多语言视觉小模型
Jina AI发布2.4B参数量的视觉语言模型Jina - VLM,在多语言视觉问答任务达SOTA。它引入注意力池化,连接视觉与语言基座,处理问答等任务,对硬件要求低,多项测试表现优,还介绍架构、训练策略和上手方式。
谷歌卷土重来:你大爷还是你大爷
上周谷歌横扫科技媒体头条,英伟达官方X账号点赞谷歌TPU成绩后话锋一转称自家产品领先。此前有传闻Meta考虑换用谷歌TPU,消息致英伟达市值蒸发、谷歌市值上涨。今年谷歌发布Gemini - 3系列模型,其自研芯片TPU引发关注。
3个月融资亿元,流形空间证明世界模型也需要预训练 | 甲子光年
2025年5月武伟创办流形空间,成立3个月获亿元融资。他认为VLA是过渡方案,世界模型是AGI新基建。当下技术分显式物理建模和隐空间交互两派,流形空间做具身世界模型,从预训练做起,还将领域模型产品化。
英伟达可能要给这个 AI Coding 投 10 亿美金,AI 提升电商交易每月增长 100% 的一个典型案例
Bloomberg消息称英伟达或向Poolside投5 - 10亿美金,该轮融资20亿,估值达120亿。Poolside由Github前CTO创立,从AI Coding产品转型基础模型公司,欲通过软件开发实现AGI,还提到AI在电商二手商品售卖的应用。
苹果不吹 AI,反而成功了?
北京时间9月10日苹果发布会,新款iPhone等产品更新。此次发布会多数环节AI几乎消失,与iPhone 16发布时大肆宣传不同。苹果因在智能体AI助手进展落后,重点放硬件及AI幕后支持。不过苹果仍承受分析师压力,且在AI竞赛中落后。
也许,该庆幸在这个时代被裁员
文章借一位失业者基于AI做产品的感慨,引出对GPT - 5发布的讨论。GPT - 5升级后被中外用户吐槽没人味,OpenAI 24小时内恢复GPT - 4o访问权限,还推出三种响应模式,这引发了对AI与人关系的思考。
支付宝“阿宝”背后的 Agentic 终端:从对话到办事,xUI 如何重构 AI 交互
本文整理自蚂蚁集团支付宝AI端云交互负责人魏凤笛的大会分享,系统介绍支付宝AI入口产品“阿宝”背后的xUI技术体系,涵盖通信、交互、执行、多Agent协同四大核心方向,分享了大厂移动端Agent落地的工程实践与未来规划。