「FP8训练」共找到 2612 篇相关文章
n8n、扣子太难用了,Vibe Workflow 才是更大众的解
本文介绍 Refly.AI 推出的 Vibe Workflow,该产品获朱啸虎、高瓴投资且开源。它让普通人搭 Workflow,用 Agent 节点替代传统节点,降低门槛,还能迁移其他平台数据,核心是借模型提升发展。
8.9K Star!号称 Notebook LM 开源平替,支持 16+AI 模型,一键部署!
Google Notebook LM 虽方便,但有数据泄露风险且被平台绑定。开源工具 `open-notebook` 是其平替,支持 16 + 家 AI 模型提供商,可处理多模态内容,能本地部署保障数据安全,还具备多种实用功能。
GitHub 1.8W star爆款!不到2M,win系统高级感拉满!
TranslucentTB是为Windows系统设计的开源轻量级工具,主打任务栏透明化。它资源占用低,功能丰富,有多种视觉效果、能智能动态切换等,还提供多种安装渠道。
Github 8.7K star 厉害!!! 一款轻量好用的web自动化项目!
Nanobrowser是开源Chrome扩展工具,专注AI驱动的网页自动化。免费且本地运行,保护隐私,支持多主流大模型。有多智能体协同等特点,还介绍了安装配置方法,是高效安全的网页自动化之选。
荣登HuggingFace周榜首位, 人大高瓴与快手提出ARPO实现智能体高效训练!
人大高瓴与快手提出的ARPO项目受高度关注,荣登Huggingface Paper日榜、周榜双首位。它是为多轮交互型LLM智能体设计的强化学习算法,在基准测试中,用一半工具调用预算就显著优于现有方法。
Meta华人新秀毕树超,重磅爆料下一代LLM路线!RL+预训练直通AGI
OpenAI前研究员、Meta成员毕树超在哥大演讲指出,AGI需高质数据、好奇驱动探索与高效算法,Scaling Law有效,规模决定智能,终身学习是重点,还探讨了AGI面临的诸多问题与挑战。
大模型如何"不训练"也能学习?——上下文学习的隐式权重更新机制
大型语言模型能通过上下文学习(ICL)在推理时即时学习新任务,无需修改模型参数。本文首次证明自注意力层与MLP层组合能隐式将上下文信息转为MLP层低秩权重更新,解释了ICL原理,为构建AI系统开辟新路径。
19.8K star!一款开源可视化工作流调度项目,轻松搞定大数据任务!
Kestra 是开源工作流编排平台,用于处理复杂任务自动化问题。它跑在 JVM 上,用 YAML 配置,支持插件扩展。适用于多种任务调度场景,有配置简单、稳定、容错等特点,安装也容易。
马斯克Grok 4正式发布:世界最大AI超级计算机就训练了这?
Grok 4公开基准测试有进步,但在高级推理测试表现差,视觉理解仍是短板。性能提升多靠整合符号工具,无重大技术创新,‘幻觉’问题没实质进展,xAI官方对道德对齐信心不足。
MIT发布自适应语言模型!新任务,自生成远超「GPT-4.1合成训练数据」
麻省理工学院提出自适应语言模型框架SEAL,让大模型生成微调数据和更新指令适应新任务。实验显示,其生成的合成数据微调效果超GPT - 4.1,在少样本学习和知识整合任务表现优异。