「消费级产品」共找到 2453 篇相关文章
14万,家务机器人带回家!斯坦福华人博士具身创业首款产品亮相
斯坦福明星华人博士生创业机器人Memo亮相,售价2万美刀。它颜值高,能做家务,在无剪辑等的demo中有出色表现。其背后是ACT - 1模型,依赖技能捕捉手套数据训练,成本低且用户可教它新本领,预计2026年推出。
开源AI真人级互动老师,多Agent+可视化画布,函数/思维导图实时作图!
本文介绍开源项目ChatTutor,它是可视化互动式AI老师,能边说边画。有数学画布、思维导图等功能,未来将支持代码、物理等画布,可用于解题、备课等,已上线chattutor.app。
刘润没说透的:AI时代,你要迁徙的不是产品,是能力
刘润年度演讲刷屏,讲了企业的大迁徙,但作者认为普通人更关键的是能力迁徙。纯执行类能力在AI时代贬值,而判断力、提问力、审校力等新能力变得重要,各领域能力正从‘执行者’向‘判断者’转变。
SOTA级的Embedding模型!F2LLM模型、数据、代码全部开源,人人可用
Embedding 模型应用广泛,但主流模型训练困难。蚂蚁集团与上海交大推出 F2LLM,含 0.6B、1.7B、4B 系列模型,仅用六百万数据微调基座,在 MTEB 榜单领先且完全开源。介绍了其数据、训练、测评等情况。
“扁平+拓扑”双索引,85页PDF"秒级"推理,MMRag幻觉率骤降76%
多模态长文档视觉问答常见于科研论文等场景,现有技术路线有大视觉 - 语言模型直接端到端和检索增强生成,但各有缺点。MMRAG - DocQA引入新方案,解决多模态连接和跨页证据链接问题。
“扁平+拓扑”双索引,85页PDF"秒级"推理,MMRag幻觉率骤降76%
文章聚焦多模态长文档视觉问答,介绍现有LVLM - based和RAG - based技术路线及困境。提出MMRAG - DocQA方案,引入‘分层索引 + 多粒度检索’,设计双索引建模相关性与依赖,用互补策略实现证据互补。
鸿蒙终端数量突破千万后,华为发布亿元级应用开发激励计划
华为宣布搭载HarmonyOS 5的终端数量突破千万后,推出「鸿蒙应用开发者激励计划2025」,上亿元补贴,单个开发者累计奖金上限600万。该计划激励力度更大、应用形态更广,意在引导开发者长期投入。
Hugging Face开源顶级模型:双模式推理+128K上下文,最强3B
今天凌晨,Hugging Face开源顶级小参数模型SmolLM3,参数30亿,性能超同类。它有128k上下文窗口,支持6种语言、双推理模式。架构细节等全开放,联合创始人强烈推荐,称是3B领域SOTA。
论文秒变海报!开源框架PosterAgent一键生成顶会级学术Poster
本文介绍开源框架PosterAgent,它能一键将论文转为可编辑的学术海报。相比GPT - 4o,其生成指标优、token使用量少、成本低。研究团队构建评估标准Paper2Poster,实验显示PosterAgent在多方面表现出色。
一键开关灯!谷歌用扩散模型,将电影级光影控制玩到极致
Google推出LightLab项目,可从单张图像精准控制光影,解决传统光影控制难题。其通过特殊数据集微调扩散模型,让模型学会控制光照,还介绍了方法、后处理流程等,实验显示表现优,有多种应用。