后训练阶段」共找到 4141 篇相关文章

新闻资讯7

龙虾之父Claude账号被封!近百万人围观:故意的还是不小心的

Anthropic状况频出,先是泄露源代码、词元计费有BUG等,现又封了龙虾之父Peter的Claude账号,称是误伤解封。此事引发近百万人关注,有人质疑A社在炒作。

量子位
新闻资讯7

LinkedIn 重构服务发现:在大规模环境中用 Kafka 和 xDS 取代 Zookeeper

LinkedIn 工程博客中,Bohan Yang 介绍升级基于 ZooKeeper 的传统服务发现平台项目。因传统系统有扩展性问题,团队开发新架构,分离读写路径,实施双读双写机制,迁移数据传播延迟显著改善。

InfoQ
新闻资讯8

产业级 Agent 如何破局?百度吴健民:通用模型难“通吃”,垂直场景才是出路

InfoQ 采访百度吴健民探讨产业级 Agent 破局点。他指出 Agentic 模型训练卡点在真实环境复刻;通用模型难“通吃”,垂直场景定制模型是关键;多模态未实现统一建模,分开优化效果更好。

AI前线
新闻资讯7

Stripe 的零停机数据转移平台以毫秒级流量切换迁移 PB 级数据

在旧金山 QCon 会议上,Stripe 工程师介绍零停机数据转移平台,能 PB 级数据库迁移,流量切换毫秒内完成,支持每秒 500 万次查询和 99.9995% 可靠性。还讲了迁移六阶段及多用途。

InfoQ
算法论文8

推理时扰动高熵词,增强LLM性能

香港科技大学(广州)研究团队发现LLM推理时,一小部分高熵词显著影响输出正确性。基于此提出MTI方法,含Selective CFG intervention与Lightweight negative - prompt guidance,无需额外训练,能提升模型推理能力。

机器之心
产品应用7

ComposeMe:让发型、服饰与身份随心组合的人体图像生成新范式

人像生成中保持效果清晰真实且自由调整细节是难题,Snap推出ComposeMe,引入‘属性特定图像提示’思路,能灵活组合属性。还建立数据集、提出训练方法,虽有局限,但表现较优。

带你学AI
产品应用7

最强AI编程工具Claude Code,五个使用Tips

作者认为Claude Code是最强AI编程工具,因Anthropic对其针对性强化训练且不计上下文消耗。国内介绍少因自媒体水平差。作者分享五个使用Tips,如/init初始化、Plan Mode规划等。

newtype AI
新闻资讯8

图灵奖得主 Yoshua Bengio 智源大会最新演讲:关于AI,我改变了信念,也改变了研究方向

2025年6月6日,图灵奖得主Yoshua Bengio在第七届智源大会发表演讲。他目睹前沿AI行为演化深感警觉,决定调整科研方向以降低AGI潜在风险,还分享AI“求生”案例,提出构建“科学家AI”新理念。

力学与人工智能
算法论文8

从答题到做实验:SciAgentGym让大模型进入科学工作流

复旦大学NLP实验室提出SciAgentGym,为科学智能体搭建工作流环境,还设计了评测集SciAgentBench。实验显示模型接入工具能提升成功率,但长流程任务性能下降。论文还提出SciForge构建训练数据,提升了模型表现。

机器之心
算法论文8

北大王选所彭宇新团队:让多模态大模型学会「看懂物种关系」丨CVPR 2026

北大王选所彭宇新团队在论文中提出TARA方法,引入生物分类学知识与多模态模型中间表征对齐。实验显示,TARA能提升模型层级识别和未知类别识别能力,还可加速训练收敛,计算开销小。

AI科技评论