从零训练」共找到 4868 篇相关文章

开源动态7

无需 OCR 就能各类文档中提取结构化信息的本地化开源工具docext

docext是无需OCR的本地化开源工具,能发票、护照等文档图像提取结构化信息。智能文档处理排行榜评估VLMs在多任务表现,docext有灵活提取、表格提取等功能。

GitHubStore
开源动态8

腾讯开源智能体新框架:不用训练无需充值,用开源模型实现SOTA Agent

智能体框架是推动智能体生态发展的基础设施,但现有框架存在上手门槛高、依赖闭源模型等问题。腾讯优图实验室开源Youtu - agent框架,无需训练模型、不依赖闭源API,性能领先,有多个核心亮点和典型应用案例。

量子位
算法论文8

EMNLP2025 | SFT与RL的结合,vivo AI Lab提出新的后训练方法

vivo AI Lab 算法团队提出新的大模型后训练框架 GTA,综合 SFT 和 RL 优点,解决文本分类场景中 RL 收敛慢问题。论文已被 EMNLP 2025 录用,介绍了 GTA 框架设计思路、实验结果等,未来还将探索更多场景和大模型。

机器之心
产品应用8

AI 时代,实时入湖正在告别 ETL: Kafka 到 Iceberg 的架构减法

在AI驱动的数据应用场景中,Kafka、Iceberg开放表格式与对象存储组合成流数据入湖重要方向。传统ETL方式有链路长等问题,文章围绕“ETL”讨论架构减法,介绍Kafka × Table Bucket方案及优势、适用场景。

阿里云开发者
新闻资讯8

GPT-5≈o3.1!OpenAI首次详解思考机制:RL+预训练才是AGI正道

OpenAI研究副总裁Jerry Tworek在播客访谈中称,GPT-5类似o3.1。他详解模型推理过程,强调RL+预训练是AGI正道,肯定DeepSeek的GRPO算法,还分享自身经历及OpenAI工作结构。

量子位
开源动态8

Generalist之后,罗剑岚团队推出LWD,也要变革具身智能训练范式

智元机器人与上海创智学院联合发布全新具身智能训练范式 LWD,可让机器人在真实世界部署中持续自主改进。它打破传统 AI 静态模式,构建数据飞轮,在四大维度创新,经测试表现出色,或成具身智能转折点。

机器之心
开源动态7

在一台1970年代的PDP-11上训练Transformer需要多久?答案是5.5分钟

近日,开发者复现1970年代技术环境,用PDP - 11汇编语言实现Transformer并训练成功,项目叫ATTN - 11。在低资源下实现功能闭环引热议,大家思考Transformer到底需要什么。

机器之心
推荐文章8

前端工程化演进之路:手工作坊到AI驱动的智能化开发

本文回顾前端开发jQuery到AI的变革,剖析工程化演进、性能优化进化,展示AI与前端深度融合新范式。还预测未来趋势,为开发者提供成长路径指导,强调工程化、性能优化、AI应用及持续学习的重要性。

阿里云开发者
新闻资讯8

“毋在浮沙筑高台”:汪源谈智能体想 80 分跨到 90 分,全卡在上下文

前网易副总裁汪源在2026奇点智能产品大会分享,指出智能体系统瓶颈正模型能力、Harness工程,转移到上下文。他还介绍了做好上下文基础设施的要点,以及推出的新内容格式KRL。

AI科技大本营
新闻资讯7

卡帕西:编程写文件变成管龙虾!IDE不会凉但得换个用法

AI Coding先锋卡帕西认为,虽AI能生成大部分代码,但IDE不会被淘汰,编程玩法变了,开发工具需进化,功能要组织文件变为高效协同智能体,还给出了新一代IDE应具备的技能。

量子位