「测试时训练」共找到 3973 篇相关文章
狂揽 9.9K star!比Selenium更好用的网页自动化利器,功能超强,太6了!
本文分享开源项目 SeleniumBase,它包装 Selenium 的 WebDriver API,功能强大。支持主流浏览器,内置测试框架,能搞定防爬检测。有智能等待等特色,安装简单,GitHub 有大量示例。
西湖大学科研版NanoBanana开源!科研绘图从此自动化
西湖大学将科研版NanoBanana开源,其AutoFigure框架可自动化生成学术插图且能编辑,论文被ICLR 2026接收。该框架提出理性渲染范式,配套FigureBench基准测试集,表现超越人类预期。
Sebastian Raschka 新书《从头开始推理》抢先看,揭秘推理模型基础
著名AI技术博主Sebastian Raschka新书《Reasoning From Scratch》第一章介绍LLM中推理含义、训练阶段、模式匹配与逻辑推理区别,还讲述提升推理能力方法及从头构建推理模型的重要性等内容。
陶哲轩DeepMind梦幻联动,最强通用科学Agent来了!一口气解决芯片设计、矩阵乘法和300年几何难题
谷歌DeepMind与陶哲轩等打造的AlphaEvolve是LLM驱动的进化编码Agent。它能优化计算生态、调度数据中心等,还解决了数学难题,已在谷歌内部使用,现开启早期邀测试用。
继火爆全网的MCP后,Anthropic 推出全新整合功能,Claude再添连接利器
继MCP后,Anthropic推出全新Integrations功能,使Claude能与各种工具和应用无缝连接,提升协作能力,其研究能力也得到增强,新功能在部分计划测试,将惠及更多用户,助力高效完成任务。
DeepSeek|从零构建轻量级vLLM:Nano-vLLM,吞吐量逼近原版,代码仅需1200行
开源的vLLM能提升LLM推理速度和资源利用率。近日,DeepSeek AI俞星凯从零构建轻量级Nano - vLLM,代码仅1200行。它有离线推理等功能,基准测试显示吞吐量逼近原版。
图像、视频一模搞定!字节全能原生多模态本地可部署
字节开源原生多模态模型Lance,仅3B激活参数,40G显存就能跑,已登顶huggingface趋势榜。它能进行图像与视频的理解、生成、编辑等操作,在多个基准测试中表现优异,多项性能居首。
ACL'25首届博士论文奖 | 重新思考 LLM 中的数据使用
近日,第一届 ACL 计算语言学博士论文奖获得者是 Sewon Min,其论文《重新思考大型语言模型中的数据使用》围绕大型语言模型如何使用训练所用的庞大文本语料库展开研究。
Anthropic 发文称自家 Claude 已经开智,网友:为了上市,不择手段?
Anthropic发布Claude内部机制新研究,介绍J-space和J-lens,称可读取模型未输出的内部概念。此研究在训练、评测和部署有潜在价值,但叙事引发争议,网友质疑是否过度包装。
清华传奇姚顺宇立功!全新Gemini一夜血洗编程,全球仅7人能赢它
谷歌Gemini 3 Deep Think重磅升级,几乎刷爆全领域SOTA。编程界冲入Codeforces人类TOP 10,人类最后考试等测试也表现优异。还能解决科研工程难题,实测物理模拟能力强,给OpenAI带来压力。