「F2LLM」共找到 2796 篇相关文章
解决算力瓶颈,给多模态瘦身!Token压缩完整图谱与选型指南
给多模态大模型瘦身是解决算力瓶颈的关键。Token压缩技术可剔除视觉冗余,提升训练与推理效率。北大等团队剖析其全貌,给出完整图谱与选型指南,还揭示了未来演进路径。
爆火Clawdbot被Claude公司强制要求改名
AI智能体Clawdbot爆火后,被Claude公司强制更名。开发者Peter虽认为名字合法,但最终妥协,新名为Moltbot。Moltbot功能强大,此前爆火带火Mac Mini销量,此次更名引发粉丝不满。
Karpathy:别再问AI「你怎么看了」,这是错误的提示词策略!
Andrej Karpathy提出不要把大语言模型看作实体,应视作模拟器。他建议探索话题时避免用‘你怎么看’提问,给出‘什么样的一群人适合探索,他们会怎么说’的更优策略,还指出不同领域影响有别。
稚晖君新大招:机器人二次开发0门槛了!
在智元机器人首届合作伙伴大会上,联合创始人稚晖君发布机器人动作与表达创作平台灵创平台。它以AI加持,能将机器人二次开发抽象成模块化工具,降低难度,适配多款机器人,10月上线beta版。
图灵奖得主Sutton再突破:强化学习在控制问题上媲美深度强化学习?
图灵奖得主Richard S. Sutton认为未来AI发展需靠强化学习。他将2024年的SwiftTD算法拓展到控制领域,提出Swift - Sarsa算法,还设计操作性条件反射基准测试。实验显示,结合预处理方法,其性能或媲美深度强化学习。
刚刚,Claude Code 发布限速令,下月生效
Anthropic宣布8月底为Claude Pro和Max订阅用户推新的每周使用限制,因其受欢迎但部分用户使用过度、成本高,还有违规共享账号情况。此决定引发网友不满,有人考虑换替代方案。
OpenAI获五角大楼2亿美元订单,迈向军工领域
OpenAI推出“OpenAI for Government”计划,为美国政府提供AI工具。首个合作是与五角大楼的试点项目,合同上限2亿美元,用于变革行政运营,州和联邦层面已有应用实例。
1200行代码逆袭!DeepSeek工程师开源轻量级vLLM,吞吐量逼近原版
开源 vLLM 可提升 LLM 推理速度和资源利用率。近日,DeepSeek 工程师俞星凯开源轻量级 Nano - vLLM,代码仅 1200 行,基准测试中吞吐量逼近原版,项目已在 GitHub 获 200 多 Star。
InfoDeepSeek:首个开放网络环境下的智能体信息搜寻质量评估基准
上海交通大学与华为诺亚方舟实验室联合推出InfoDeepSeek,它是首个评估真实动态网络环境下智能体信息搜寻质量的基准。该基准有挑战性问题、真实动态环境等亮点,还开展实验揭示智能体行为特性。
Dify、n8n、扣子、Fastgpt、Ragflow到底该怎么选?超详细指南来了。
文章从实用角度出发,对Dify、Coze、n8n、FastGPT和RAGFlow五款主流平台进行详细功能对比,结合真实使用体验和应用场景,为不同需求者提供选择指南,还给出选型考量要素。