「长视频数据」共找到 3809 篇相关文章
阿里巴巴新论文:让LLM学会管理记忆,告别人工规则
大型语言模型处理长对话或复杂任务时,记忆管理靠人工规则,效果有限。阿里巴巴团队新论文提出把记忆管理变为可学习的强化学习策略,AgeMem框架统一长短期记忆管理,经三阶段训练,效果显著。
利用Loop语言模型扩展隐式推理 | 直播预约
当前大语言模型依赖显式文本生成推理,未充分利用预训练数据。将介绍最新工作Ouro,Loop语言模型家族,核心创新多,虽参数少却性能优,还会讨论其推理轨迹及模型Scaling新可能。
独家对话前华为天才少年李元庆:首款规模化具身智能产品中国造!多机异构是未来方向
前华为天才少年李元庆加入乐享科技,负责创新业务与技术攻关。他指出世界首个体量化具身智能产品可能在中国出现,多机异构是未来方向,还谈具身智能发展现状、难题及应对策略,分享未来规划与建议。
除了写代码,Claude 还能……种菜
开发者Martin DeVido让Claude全权照顾番茄苗Sol,无人类备份与手动干预。Claude通过传感器获取数据,控制设备运行。期间经历系统崩溃等危机,36天后Sol枝繁叶茂,Martin不鼓励买代币,可去网站看直播。
宇树IPO搁浅传闻满天飞,王兴兴:别当真,也不用和外人解释
宇树科技回应“A股上市绿色通道被叫停”传闻,称未申请绿通,上市工作正常推进,还发H2机器人训练视频。创始人王兴兴称消息是乱编的,别当真也不用解释,相关不实报道已下架。
AI4S回归白盒符号主义,清华等联合发布SR-LLM:自主发现科学知识
清华大学等多所高校联合发布SR - LLM,这是融合大语言模型与深度强化学习的符号回归框架。它从数据生成可解释数学模型,在跟车行为建模等任务表现优,为机器自主科学发现开辟新路径。
8亿!OpenAI发布企业AI现状报告
OpenAI发布《2025年企业AI现状报告》,基于真实数据与调研公开企业级AI使用规模。ChatGPT周服务超8亿用户,企业端增长惊人,各行业渗透加速,员工也感受到实际价值,同时前沿与普通用户差距拉大。
Deepseek是被降智了吗?
作者认为Deepseek被降智,存在诸多问题,如不懂用户意图、长文理解差、措辞怪异、提示词调教难、无脑捧杀、幻觉率高、深度思考弱等,还对比了与GPT在人际交往话题回复上的差异。
以小博大!Nanbeige4-3B重磅开源:硬刚Qwen3,挑战小模型能力新高度
近年来大语言模型参数膨胀,成本升高,业界重注小语言模型。近日,Boss直聘南北阁大模型实验室发布仅30亿参数的Nanbeige4 - 3B,在多方面媲美甚至超越通义千问Qwen3系列模型,开源印证小模型潜力。
Jina AI创业复盘:AI团队的Scaling Law是什么
文章是Jina AI创始人肖涵的创业复盘。他率团队六年创业后将公司出售,期间两次转型,聚焦搜索底座模型。他分享创业经历、公司命名、业务调整等,还谈收购、模型竞争、未来创业方向及给创业者的建议。