「数据使用」共找到 3675 篇相关文章
一个Dispatch Dtype引起的fp8 quant kernel性能问题
文章记录SGLang社区在sgl-kernel中解决的fp8 quant kernel性能问题,因错误使用`c10::Float8_e4m3fn`数据类型,未用硬件加速指令,通过软件调用致性能下降,现已修复,vLLM也应用此修复。
对噢!为什么LMs就不能直接输出答案+confidence呢?
当前语言模型在复杂问答任务中存在校准退化问题,本文提出RLCR方法,将概率校准融入RL训练目标,重构奖励函数,在多个数据集实验中显著降低校准误差,不损失准确性,为高风险场景AI部署奠基。
云计算一哥,刚刚重新定义了AI Agent的玩法
亚马逊云科技在纽约峰会上重新定义AI Agent部署方式,发布Amazon Bedrock AgentCore工具包,还推出Marketplace中的AI Agents和工具、Amazon Nova定制化功能等,在数据层和编程应用也有新动作,展现其AI Agent战略布局。
海螺新模型海外爆火:一夜之间,猫、羊驼、长颈鹿都学会跳水了
国内AI公司Minimax的新模型‘Hailuo 02’本周三官宣上线,在海外爆火。其生成的动物跳水等复杂运动视频AI痕迹不明显,官方称它是全球唯一能处理类似体操高度复杂场景的模型。该模型使用NCR架构。
拒绝强行AIGC!| 一种安全实用、准确率高的Text2Sql方案
在金融、医疗等对精确性、透明度和安全性要求高的领域,完全依赖大模型NL - to - SQL能力易出错。本文提出基于函数调用LLM的新范式,将LLM能力聚焦于调用预定义功能函数,提升了数据检索的准确性、透明度和可维护性。
「Next-Token」范式改变!刚刚,强化学习预训练来了
微软新研究提出「强化预训练(RPT)」新范式,将下一个 token 预测任务重新定义为推理任务,可利用海量文本数据进行通用强化学习。该方法有可扩展性、低风险等优点,实验显示其提升了语言建模能力。
阿里Qwen3一口气开源多个向量&排序模型,冲!
今天阿里正式开源Qwen3-Embedding和Qwen3-Reranker系列,为多语言文本嵌入和相关性排序树立新标杆。提供0.6B/4B/8B三种版本,支持119种语言,在多个数据集达先进性能,赋能多种应用场景。
Cursor迎来史诗级更新,关于Cursor 1.0.0版本,这里有你需要知道的一切!
2025年6月5日,上线2年的Cursor迎来首个正式版1.0.0。此次更新功能多且关键,如上线代码审查工具Bugbot、全面开放后台代理功能等,虽提升了开发效率,但部分功能有使用成本,对新手不太友好。
OpenAI久违发了篇「正经」论文:线性布局实现高效张量计算
OpenAI 近日发布研究论文,提出用于高效张量映射的统一代数框架 Linear Layouts,解决了 Triton 等深度学习编译器中长期存在的难题。该框架是使用二元线性代数的张量布局通用代数形式,评估显示其优化版 Triton 性能有提升。
DeepSeek R1 的小更新,却大有深意?
5月28日,DeepSeek低调宣布R1模型小版本试升级,API接口和使用方式不变,但未公布具体更新内容。从用户反馈看,语义理解、逻辑推理等能力提升,实测表现出色。此次升级或有安全、产品路线等考量。