「时长控制」共找到 1601 篇相关文章
前OpenAI科学家&GPT之父:预训练精准数据过滤,极低成本削弱大模型危险能力数千倍
Claude价值观塑造者Neil Rathi和GPT之父Alec Radford发论文,提出预训练时精准“删掉”危险知识碎片,以极低计算成本将大模型特定危险能力削弱数千倍,且不损通用智能。
6张图看清中美AI竞赛:美国领先在哪,中国优势在哪
TIME杂志文章用六张图表解析中美AI竞争,指出美国在芯片控制、模型性能和商业变现领先,中国受算力瓶颈制约,但在人才基础和能源供给有优势,特朗普新出口规则或带来转机。
Anthropic 黑客松冠军开源神作!3 万人收藏的神级 Claude Code 升级包!
Claude Code在处理复杂项目时存‘记性不好’等问题,单打独斗难敌复杂工程需求。Anthropic黑客松冠军得主开源Everything Claude Code项目,涵盖多模块,是系统化AI协作体系,已获30K+ Star。
盐城芯片大佬,静待两个千亿IPO
芯片大佬朱一明即将迎来高光时刻,1月13日其控制的兆易创新将登陆港交所,长鑫也递交了招股书。存储芯片行业需求旺盛、价格上涨,朱一明想把兆易创新做成中国的“三星半导体”。
社区供稿丨如何抑制大模型的“过度反思”:Yuan3.0 Flash 中的强化学习范式
大模型在企业落地时存在“过度反思”问题,浪费算力。YuanLab.ai团队在Yuan3.0 Flash模型中提出RIRM与RAPO,前者奖励“思考过程”,后者优化训练框架,实现推理效率提升,适用于企业场景。
AgentCPM-Explore开源,4B 参数突破端侧智能体模型性能壁垒
当行业争论30B能否挑战万亿参数时,清华、人大、面壁智能与OpenBMB联合研发的AgentCPM-Explore开源,基于4B参数在深度探索任务表现出色,还开源配套平台,解决小模型性能提升难题。
从HITL(Human In The Loop) 实践出发看Agent与设计模式的对跖点
本文围绕在 ReactAgent 中引入并实践 HITL 机制展开,介绍实现方案与代码设计。分析无通用人机协同时的问题,阐述 HITL 核心要点、实现效果与细节,还探讨 Agent 演进与工程设计模式的关联。
谷歌看了都沉默:自家「黑科技」火了,但为啥研发团队一无所知?
当科技圈为‘谷歌黑魔法’兴奋时,所谓‘并行验证循环’可能是AI生成的‘赛博跳大神’。它号称超越思维链,性能提升显著,但发帖者身份存疑,无可靠源链接,其真实性遭业内质疑。
无问芯穹首曝智能体服务平台,以基础设施加速企业级「智能体自由」
12月16日,无问芯穹在智能体生态论坛发布智能体服务平台。该平台为企业提供全链路陪伴式落地服务,解决生产级智能体落地和规模化的难题,助力企业实现智能体的高效商业化落地与可持续运营。
X爆火Overleaf科研辅助神奇PaperDebugger
当下学术写作借助大语言模型辅助时,流程繁琐且上下文易丢失。新加坡国立大学团队推出的 PaperDebugger 是基于插件的多智能体系统,寄生在 Overleaf 编辑器内,可完成多任务,解决现有工具不足。