「AI模型训练」共找到 13906 篇相关文章

推荐文章7

从“铁三角”到“六有”组织,北银金科如何打造千人高密度数智化团队?| 极客时间企业版

在2025 DTDS全球数智人才发展大会上,北银金科赵瑞兰介绍数智化转型实践。北银金科构建“ACT”模型,打造“六有”组织文化,开发人力看板等成果,未来愿与伙伴探索AI时代。

InfoQ
开源动态8

刚刚,DeepSeek全新多模态技术开源!

DeepSeek联合北大、清华开源多模态技术及论文,提出“视觉基元推理”框架,解决MLLM指代鸿沟问题。基于DeepSeek - V4 - Flash构建的模型,性能比肩GPT - 5.4等。论文还介绍架构、训练流程等。

PaperAgent
新闻资讯8

PC 软件为手机重做了一遍,现在轮到 Agent 了

2月10日,笔记软件Obsidian发布含命令行工具的1.12版,画图工具Draw.io和Excalidraw发布MCP接口,显示软件正为AI Agent重做接口。此前Anthropic和OpenAI也发布了强大的Agent模型。

宝玉AI
产品应用7

n8n、扣子太难用了,Vibe Workflow 才是更大众的解

本文介绍 Refly.AI 推出的 Vibe Workflow,该产品获朱啸虎、高瓴投资且开源。它让普通人搭 Workflow,用 Agent 节点替代传统节点,降低门槛,还能迁移其他平台数据,核心是借模型提升发展。

探索AGI
算法论文8

推理时扰动高熵词,增强LLM性能

香港科技大学(广州)研究团队发现LLM推理时,一小部分高熵词显著影响输出正确性。基于此提出MTI方法,含Selective CFG intervention与Lightweight negative - prompt guidance,无需额外训练,能提升模型推理能力。

机器之心
算法论文8

Agent进入下一篇章!Alita:不靠人工预设,自己造工具,成绩碾压OpenAI

当前AI Agent依赖人工预设,存在工具不够用、缺乏创造力、兼容性差等问题。Alita秉持少预设多进化理念,用MCP协议,架构含三大模块,实验成绩超OpenAI,还能让小模型提效。

深度学习自然语言处理
推荐文章7

本周六直播预约 | Test-Time Reasoning综述分享!

当大模型训练成本飙升、数据枯竭,推理阶段扩展Test-Time Scaling(TTS)成研究热点。论文提出四维正交分析框架,梳理主流技术路线,提炼发展路径,给出操作指南与未来思考,本周六将直播分享该综述。

深度学习自然语言处理
开源动态9

Jev火爆全网后,Open Jev们扎堆开源了!精选8个项目

TypeSafe AI发布的Jev模型凭借新的结构化决策接口迅速爆火,引发社区复刻潮。本文精选整理了8个不同技术路线的开源OpenJev项目,逐一介绍各项目的思路、性能、优缺点与适用场景。

GitHubStore
产品应用7

Current Robotics 发布 Curr-0:以 Single Policy 实现全身灵巧操作

Current Robotics发布Curr - 0,解决人形机器人移动与操作分离困境。它用Single Policy统一训练,基于HumanEx采集数据,还构建多物理模态交互世界模型,是全栈具身智能基础设施成果。

AI科技评论
新闻资讯7

The Batch: 973|Claude 的水印如何运作

Anthropic将在2026年8月2日后发布的Claude模型全球部署肉眼不可见、机器可读的水印,用于表明文本和图像由其生成。该技术基于Google的SynthID - Text,不过此公告引发广泛争议。

DeeplearningAI