「小模型推理能力」共找到 9427 篇相关文章
支付宝 AI 出行助手高效研发指南:4 人团队的架构迁移与提效实战
本文介绍支付宝AI出行助手研发历程,其集成多种出行功能,基于xUI + KMP框架搭建。分享研发实践、挑战与策略,如迁移基础能力、卡片生态,适配标准框架,还提及KMP应用及数据度量体系,取得业务和研发效能成果。
4 万星开源项目被指造假!MemGPT 作者开撕 Mem0:为营销随便造数据,净搞没有意义的测试!
高人气开源智能体记忆项目 Mem0 发布论文,称在 LOCOMO 测试打败对手。MemGPT 创始团队 Letta AI 联合创始人公开指控其造假,称测试无意义,自己轻松超其基准数据。二者都为解决大模型长期记忆问题而诞生。
单卡4090也能高质量视频编辑!西湖AGI Lab无训练框架FlowDirector来了
视频编辑门槛高、现有方法开销大且效果不佳。西湖大学AGI Lab团队提出无需训练的FlowDirector框架,可将基于流的视频生成模型改造成编辑工具,质量高、功能广、开销低,解决了时序、结构和编辑幅度问题。
T-PAMI|中国科大、合工大等提出CAPER++:让关节物体位姿感知真正迈向「又快又稳」
在具身智能发展下,关节物体位姿感知难题待解。中国科大、合工大等团队提出 CAPER++ 框架,从关节驱动视角建模,将位姿学习拓展至 SE (3) 流形切空间,实现端到端推理,兼顾精度、鲁棒性与实时性。
GAIR 2025 大会首日:AI重构教育、科学与产业的十三重碰撞
2025年12月12日,第八届GAIR全球人工智能与机器人大会在深圳开幕。众多顶级学者围绕AI对教育、产业等领域的影响发表演讲与讨论,如赵伟院士提出高校“加减替换”培养模式,贾佳亚教授认为大模型将走向“感知机器+终身学习”模式等。
开源真强大,不敢相信,太真实,揭秘8.3k star 开源神器 VoiceCraft 如何封神!!!
VoiceCraft 是多团队合作推出的零样本语音编辑与 TTS 开源项目。它能几秒克隆语音,实现编辑功能,支持零样本文本转语音,在真实场景音频中性能超 XTTS - v2、VALL‑E 等模型,解决了内容创作和编辑痛点。
从亚太到欧美,阿里云瑶池数据库凭何成为中企出海的技术底气?
在中企出海迈向‘深水区’时,阿里云瑶池数据库成关注焦点。它涵盖多版块,能提供全链路生命周期服务。对话负责人薛菲可知,其满足出海数据库需求,在多场景表现出色,融入AI能力,获国际认证,为中企出海提供底气。
传言称:Llama 4 团队80%成员集体辞职!
有爆料称Meta的Llama 4团队约80%成员集体辞职,引发AI圈关注。但Meta员工澄清该消息不准确,且无权威媒体证实。不过Meta和Llama 4项目确实面临高层动荡、模型延期等问题,还分析了可能的深层原因。
奥特曼最新深度访谈:AI至今没有iPhone时刻!
OpenAI首席执行官山姆·奥特曼在深度对谈中复盘大模型发展,谈及砍掉Sora和自研浏览器聚焦平台,认为AI缺iPhone时刻,还分享ChatGPT决策过程、创业经历,提出从成功学经验等观点,反驳末日论。
15年差评如潮,Siri终于有救了!苹果10亿真金白银投谷歌一票
苹果宣布和谷歌合作,用Gemini升级Siri等AI功能,此为过渡方案,苹果未来计划推自研1万亿参数模型。此前谷歌每年付苹果200亿做搜索,这次苹果或每年付10亿用Gemini。