「使用限制」共找到 1541 篇相关文章
新手必看!强化学习入门指南 | 从RLHF、PPO、GRPO到RLVR,最后到训练推理模型
Unsloth团队发布强化学习教程,从吃豆人谈起,介绍RLHF、PPO、GRPO等概念,分享用GRPO训练推理模型技巧。涵盖强化学习基础知识,还给出Unsloth使用GRPO训练模型方法及奖励函数示例。
Andrej Karpathy 分享ChatGPT模型选择指南
前OpenAI创始成员Andrej Karpathy发文分享ChatGPT模型使用指南,点出关键事实,如o3适合重要任务。社区热烈讨论,专业用户分享策略,还对o4 - mini等模型表现给出反馈。
o3崛起,但推理模型离「撞墙」只剩一年?
OpenAI的o3推理模型诞生不到一年能力突飞猛进,算力暴增10倍。但Epoch AI等警告,最多一年推理模型或撞上算力资源极限。还从其他模型和业内人士看法分析推理算力,指出算力与性能有关联,也有发展瓶颈。
字节开源多模态复杂文档解析模型!Dolphin:页面与元素并行解析,精准解析复杂文档!
多模态AI与文档解析兴起,传统OCR解析复杂文档常出错。字节跳动开源多模态模型Dolphin,通过两阶段机制精准解析,有多种功能,安装使用友好,适用于多场景,降低了复杂文档解析门槛。
AutoDev 预上下文引擎:预生成代码语义化信息,构建 AI 编程的知识基座
文章介绍 AutoDev 预上下文引擎,指出向量化代码检索性价比低,提出用预生成上下文提升 RAG 效果。Context Worker 能深度解析代码,支持多语言,使用简单,还可结合 MCP 服务获取上下文知识。
专访微软CTO:微软大力发展Agent,智能体将无处不在
微软CTO Kevin Scott在“Build2025”大会期间接受专访,解读微软推动智能体生态发展。微软重视智能体应用,众多组织用其平台开发。他还探讨编程看法、行业变化、安全模型、市场模式等问题。
CoT推理大溃败?哈佛华人揭秘:LLM一思考,立刻就「失智」
新研究揭示思维链CoT会分散模型「注意力」,使大模型推理时易出错。研究指出在需遵守指令任务中,用CoT推理模型准确率下降,还总结了四大模式,并提出四种缓解策略。
终于用上啦,3.9 万 Star archify,程序员福音!!!!
架构图常与代码脱节,约3.9万Star的archify让Agent先把代码库或系统描述写成带类型的JSON,经布局、检查后交付可交互系统地图,它先结构化、验证再交付,适用于特定场景。
骨灰级克隆网站设计的开源项目
现在克隆网站设计常停留在截图和吸色,难以完全还原。designlang 项目用无头浏览器打开 URL,从实时 DOM 读取设计系统,输出多个文件,还能做到布局模式等其他提取器做不到的事。
重磅!OpenAI深夜发布GPT-6 Astra,总裁Brockman:这就是AGI
OpenAI发布GPT-6 Astra,总裁称实现了AGI。它在多基准测试成绩优异,能独立完成复杂工作,网络安全能力强。但推理难监控,其即日起向特定机构开放,有使用价格标准。