测试时训练」共找到 3967 篇相关文章

推荐文章7

听说,大家都在梭后训练?最佳指南来了

大模型代,Scaling Law 边际效益递减,业界转向后训练。《Post-training 101》博客可助初学者入门,涵盖从预训练到指令微调、SFT 原理、多种强化学习技术及模型评测方法等内容。

机器之心
推荐文章8

让AI变成Super员工的秘密:高效训练Skills

文章复盘打造 web - testing Skill 的 4 个翻车教训,分享工程化训练心法。指出训练 Skill 能让 AI 在业务里更可靠,将通用模型变成懂业务、会自检、能稳定交付的员工,还给出训练方法。

腾讯技术工程
开源动态7

给Kali 加个MCP,直接用cursor做渗透测试

文章围绕用MCP调用Kali进行渗透测试展开,介绍国外大神实现此方法并开源。阐述系统原理、Cursor配置,通过实际测试展示效果,指出MCP让渗透测试调用更简洁,是较大进步,还给出了代码链接。

AI与安全
新闻资讯7

什么都不做就能得分?智能体基准测试出现大问题

随着AI智能体走向实际应用,其基准测试变得至关重要。但现有基准测试问题多,如WebArena判错答案、τ - bench给无操作智能体高正确率。文章提出有效性判据和ABC清单,还揭示主流基准测试诸多问题。

机器之心
产品应用7

从人工到AI驱动:天猫测试全流程自动化变革实践

AI代,天猫技术质量同学探索AI在测试全流程提效的落地方案,将传统测试工作链拆解为五阶段,目标是实现全流程自动化等。介绍了测试体系变革、所需关键能力、技术架构及落地收获与未来趋势。

阿里云开发者
新闻资讯7

为了训练AI,Meta强制监控了员工的鼠标和键盘

近日,Meta宣布在美国员工电脑装追踪软件,记录鼠标、键盘操作及截取屏幕内容,用于训练AI。这引发员工愤怒,Meta CTO称员工无法退出。Meta AI投入大,此举或因缺训练数据,但也被质疑是在训练替代者。

DeepTech深科技
开源动态8

Thinking Machines 发布又一神作「在线策略蒸馏」 ,LLM后训练效率飙升50-100倍

Mira的THINKING MACHINES开源「在线策略蒸馏」LLM后训练方法,结合两种主流后训练范式优点,提升训练效率50 - 100倍,成本降低9到30倍,可用于数学推理、模型个性化等场景。

AI寒武纪
开源动态8

蚂蚁灵波开源LingBot-VLA后训练代码!150条示教数据即可适配新机器人

蚂蚁集团旗下灵波科技全面开源具身基座模型LingBot-VLA的真机后训练工具链,覆盖四个关键环节。模型基于2万小真实机器人数据预训练,仅需150条演示数据就能迁移任务,训练效率更高。代码库已在GitHub开源。

量子位
开源动态8

具身智能迎来ImageNet刻:RoboChallenge开放首个大规模真机基准测试

近日,RoboChallenge推出全球首个大规模、多任务真机基准测试。它构建开放、公正、可复现的‘真实考场’,为视觉 - 语言 - 动作模型提供评估标准,推动具身智能发展,还提供远程测试服务等。

机器之心
新闻资讯7

【独家】对话汤元科技任冬淳:物理AI的瓶颈,在于训练体系|甲子光年

对话汤元科技任冬淳,探讨物理AI瓶颈。他认为物理AI瓶颈在训练体系,要满足数据结构质量、训练验证闭环、数据规模效率三要求。汤元构建训练底座,为具身智能和智驾提供服务,具身智能是未来重心。

甲子光年