「研究与产品」共找到 8017 篇相关文章
大模型微调评测入门:看懂这些指标,才知道模型好不好
文章指出大模型微调中很多新手重“调”轻“评”,评测是决定模型落地的关键。介绍分类和生成任务评测指标,给出实操步骤,还说明如何综合判断模型好坏,最后展望评测技术朝自动化等方向发展。
100万辆“斩杀线”出现,2026年中国智驾进入淘汰赛|甲子光年
2025年中国智能驾驶行业进入规模与交付主导阶段,100万辆成为2026年智驾行业‘斩杀线’。华为已跨过‘安全区’,地平线、卓驭等构成一线梯队。毫末智行等公司因技术与交付问题出局,行业竞争更残酷。
开源医疗模型SOTA:蚂蚁健康发布百亿参数医疗大模型
由浙江省卫生健康信息中心、蚂蚁健康等联合开发的AntAngelMed医疗大模型正式开源。它凭借独创训练与架构,在权威评测中表现优异,降低算力门槛,将专业知识、诊疗能力与计算架构融合,为医疗AI落地奠基。
救命!和漫画角色聊上头了,AI陪伴的新答案有了
快看漫画2.0版本推出AI陪伴互动漫画,将AI嵌入漫画角色,玩家以第一视角改写故事。它解决了AI陪伴产品痛点,靠共同经历和叙事上下文存续关系,还集成多家AI技术,内测数据显示有商业潜力。
企业级消息系统构建指南
文章介绍企业级消息系统构建,阐述概念、价值、典型场景,对比主流开源系统如 Kafka、Pulsar 等。通过腾讯、华为等企业实践展示选型与优化,还提及运维保障,指出未来消息系统在 AI 领域机遇与挑战。
庞若鸣还有苹果论文?改善预训练高质量数据枯竭困境
苹果基础模型原负责人庞若鸣在 Meta 任职期间,其在苹果参与的高价值研究仍不断发表。研究团队针对大模型训练中高质量数据枯竭问题,提出 Synthetic Bootstrapped Pretraining (SBP) 预训练流程,提升模型性能。
享年101岁!AI之父明斯基的「反对者」走了,一生都在寻找另一种AI
8月10日,AI先驱Warren Brodey逝世,享年101岁。他曾将控制论用于家庭研究,后赴MIT研究AI。他不赞同Minsky的AI路径,倡导以技术增强人类潜能,还开发「软建筑」等,对AI前景谨慎乐观。
AI 的下一个战场:端侧模型崛起
大模型退烧,小模型接棒。腾讯、阿里等大厂纷纷官宣小模型成果,英伟达、OpenAI 等也有相关动作。端侧模型赛道广阔,但技术含量不低,面壁智能在端侧模型探索上成果丰硕,其 MiniCPM 系列不断迭代,还在多领域落地。
Discrete Tokenization:多模态大模型的关键基石,首个系统化综述发布
近年来,人们关注将LLM能力扩展至非文本模态,Discrete Tokenization成关键方案。但现有研究缺系统总结,香港科技大学等团队发布首个相关系统化综述,梳理技术脉络、方法及挑战,给出未来研究方向。
LeCun亲自官宣!Meta世界模型V-JEPA 2登场!仅用62小时机器人数据,就能实现零样本控制!
Meta发布V-JEPA 2世界模型及三个新基准测试,Meta首席AI科学家Yann LeCun介绍其不同。V-JEPA 2基于视频训练,用62小时机器人数据就能实现零样本控制,还将探索分层式模型和多模态建模。