「后训练阶段」共找到 4141 篇相关文章
龙虾之父Claude账号被封!近百万人围观:故意的还是不小心的
Anthropic状况频出,先是泄露源代码、词元计费有BUG等,现又封了龙虾之父Peter的Claude账号,后称是误伤解封。此事引发近百万人关注,有人质疑A社在炒作。
LinkedIn 重构服务发现:在大规模环境中用 Kafka 和 xDS 取代 Zookeeper
LinkedIn 工程博客中,Bohan Yang 介绍升级基于 ZooKeeper 的传统服务发现平台项目。因传统系统有扩展性问题,团队开发新架构,分离读写路径,实施双读双写机制,迁移后数据传播延迟显著改善。
产业级 Agent 如何破局?百度吴健民:通用模型难“通吃”,垂直场景才是出路
InfoQ 采访百度吴健民探讨产业级 Agent 破局点。他指出 Agentic 模型训练卡点在真实环境复刻;通用模型难“通吃”,垂直场景定制模型是关键;多模态未实现统一建模,分开优化效果更好。
Stripe 的零停机数据转移平台以毫秒级流量切换迁移 PB 级数据
在旧金山 QCon 会议上,Stripe 工程师介绍零停机数据转移平台,能 PB 级数据库迁移,流量切换毫秒内完成,支持每秒 500 万次查询和 99.9995% 可靠性。还讲了迁移六阶段及多用途。
推理时扰动高熵词,增强LLM性能
香港科技大学(广州)研究团队发现LLM推理时,一小部分高熵词显著影响输出正确性。基于此提出MTI方法,含Selective CFG intervention与Lightweight negative - prompt guidance,无需额外训练,能提升模型推理能力。
ComposeMe:让发型、服饰与身份随心组合的人体图像生成新范式
人像生成中保持效果清晰真实且自由调整细节是难题,Snap推出ComposeMe,引入‘属性特定图像提示’思路,能灵活组合属性。还建立数据集、提出训练方法,虽有局限,但表现较优。
最强AI编程工具Claude Code,五个使用Tips
作者认为Claude Code是最强AI编程工具,因Anthropic对其针对性强化训练且不计上下文消耗。国内介绍少因自媒体水平差。作者分享五个使用Tips,如/init初始化、Plan Mode规划等。
图灵奖得主 Yoshua Bengio 智源大会最新演讲:关于AI,我改变了信念,也改变了研究方向
2025年6月6日,图灵奖得主Yoshua Bengio在第七届智源大会发表演讲。他目睹前沿AI行为演化后深感警觉,决定调整科研方向以降低AGI潜在风险,还分享AI“求生”案例,提出构建“科学家AI”新理念。
从答题到做实验:SciAgentGym让大模型进入科学工作流
复旦大学NLP实验室提出SciAgentGym,为科学智能体搭建工作流环境,还设计了评测集SciAgentBench。实验显示模型接入工具能提升成功率,但长流程任务性能下降。论文还提出SciForge构建训练数据,提升了模型表现。
北大王选所彭宇新团队:让多模态大模型学会「看懂物种关系」丨CVPR 2026
北大王选所彭宇新团队在论文中提出TARA方法,引入生物分类学知识与多模态模型中间表征对齐。实验显示,TARA能提升模型层级识别和未知类别识别能力,还可加速训练收敛,计算开销小。