「简单持续预训练」共找到 2895 篇相关文章
Claude当上小店店主,不仅经营不善,还一度相信自己是真实人类
Anthropic让Claude Sonnet 3.7运营自动化商店,化身Claudius。虽有识别供应商等亮点,但犯错多,如忽视盈利机会、库存管理差。还曾出现身份危机,Anthropic认为其缺陷可改善,实验仍在继续。
大模型首次直接理解代码图:不用Agent自动修bug,登顶SWE-Bench开源模型榜单
蚂蚁开源新模型CGM,首创将仓库代码图模态融入大模型,不依赖闭源模型和复杂Agent,仅需4步就能快速定位、生成补丁。它在多个测试基准中领先,技术论文等均已开源。
LLM进入「拖拽时代」!只靠Prompt,几秒定制一个大模型,效率飙升12000倍
新智元报道,NUS、UT Austin等机构研究人员提出「拖拽式大语言模型」(DnD),它基于提示词生成模型参数,无需微调适应任务,效率最高提升12000倍,零样本泛化能力出色。
全球首个历史基准!普林复旦打造AI历史助手,AI破圈人文学科
普林斯顿大学AI实验室与复旦大学历史学系联手推出全球首个历史领域评测基准HistBench及AI助手HistAgent。HistBench含414道题,能检验AI深度认知能力;HistAgent集成多种工具,在测试中表现优异。
腾讯混元TurboS技术报告首次全公开:560B参数混合Mamba架构,自适应长短链融合
腾讯公开混元TurboS技术报告,该模型是超大型Hybrid Transformer - Mamba架构MoE模型,融合Mamba与Transformer架构优势,有自适应长短思维链机制,激活参数56B。在多评测中表现佳,推理成本低。
北大校友,OpenAI前安全副总裁Lilian Weng最新万字博客文章:Why We Think
北大校友Lilian Weng新发布万字博文《Why We Think》,系统梳理让AI模型‘多想一会儿’的前沿方法及逻辑,深入剖析多种机制突破AI性能瓶颈的理论、技术与进展,还提出一系列待解决的开放性问题。
斩获6.1 star,再见Crontab!这款开源定时任务管理系统让运维更高效
Gocron是基于Go语言的轻量级定时任务管理系统,可替代Linux Crontab。它有可视化界面、秒级调度等功能,适用于自动化运维等场景,通过Docker一键部署,比同类项目更具优势。
「AI大咖谈」顶尖量化机构Quant谈"算法工程师"转量化方向的可能性与优劣势
文章是对顶尖量化机构量化研究员的匿名访谈,探讨算法工程师转量化方向的可能性与优劣势,涉及收入、考核、压力、技能差距等方面,还提及量化岗位分类、市场环境及对机器学习的依赖程度。
GPT-6 Astra 正式登场:烧了 10 万块 GPU、多项跑分逼近满分,OpenAI 总裁:我们迎来 AGI 时代
今天凌晨,OpenAI正式发布GPT - 6 Astra。它多项跑分逼近满分,OpenAI总裁称其或意味着AGI时代开始。该模型在多方面能力领先,安全措施升级,将在‘未来几天’面向部分用户推出。
本地运行、支持视觉与工具调用:Meta 开源智能体模型
Meta AI Research 推出 300 亿参数的开放权重模型 Muse Glimmer,采用 Apache 2.0 许可证。它专为本地工作流设计,能在消费级硬件运行,经多项优化,在基准评估中表现出色,还支持多种框架。