多语言翻译」共找到 4869 篇相关文章

新闻资讯7

刚刚!Thinking Machines Lab | 长文揭开LLM推理不确定性真相!

Thinking Machines Lab发布《克服LLM推理中的不确定性》,揭示大语言模型推理不确定性原因,并非“并发 + 浮点”假设那么简单,主要是负载及batch size不确定所致,还给出让核函数有批次不变性的方法及实验结果。

AINLPer
开源动态8

10% KV Cache实现无损数学推理!这个开源方法解决推理大模型「记忆过载」难题

推理大模型推理时易现冗余问题,R-KV开源方法登场,显存降90%、吞吐提6.6倍、准确率达100%。它通过实时对token排序解决冗余,还经步骤压缩KV缓存,性能测试表现出色,适用场景。

量子位
开源动态8

55.9K star!微软硬核开源文档转换神器,LLM最佳拍档!

介绍微软开源的轻量级Python文档转换工具MarkItDown,它支持20+格式智能转换为结构化Markdown,专为LLM文本分析场景优化,解决开发者处理格式文档痛点,还阐述其功能、技术架构等内容。

小华同学ai
算法论文8

CVPR 2026 | 1000万段驾驶视频,教会模型如何估计相机位姿

Wayve的LA - Pose研究,不依赖百万级3D标注,从约1000万段未标注驾驶视频自监督学习‘潜在动作’,再用少量3D标注微调,转化为相机位姿估计能力,在基准上提升精度且泛化能力强。

机器之心
产品应用7

Karpathy又双叒叕发新概念了,这次我替你找到了那个产品

Andrej Karpathy提出将LLM算力用于建知识库,引发关注但搭建有门槛。网易有道新出的有道宝库功能类似,能自动理解整理资料,有追问、模态输出等功能,还打通翻译链路,目前免费内测。

花叔
新闻资讯8

Agent取代App、机器人“盲区”、RAG成本失控……2026 奇点智能技术大会首批议题发布

4月17 - 18日,CSDN与奇点智能研究院联合主办的「2026奇点智能技术大会」将在上海举行。大会首次剧透部分核心议题,覆盖AI全生命周期各层面,位技术专家将分享实战经验与前沿探索。

AI科技大本营
算法论文8

LLM内部竟藏着众策略模型?自所&腾讯团队首次揭示大模型RL新机制

中国科学院自动化研究所与腾讯AI Lab团队从可解释性分析出发,发现LLM内部含个可采样内部策略,揭示不同模型推理熵模式,提出BuPO算法,在复杂推理任务上性能显著优于传统算法。

深度学习自然语言处理
开源动态8

秋招超强助攻:零基础1小时上手GPT微调!全流程教程免费开源

新一年秋招季,岗位对AI能力要求提升。OpenAI发布新开源大模型GPT - OSS,博主Lorentz Yeung开源本地部署和微调训练GPT - OSS的教程,助零基础者上手,还介绍环境搭建、代码和训练前后效果对比。

新智元
算法论文8

如何将LLM的"思考习惯"迁移到视觉领域?

传统模态模型处理复杂视觉推理能力不足,OVR团队以Qwen2.5 - VL - 7B为基础构建开源强化学习框架,成果模型OVR在12个基准测试刷新记录,揭示认知行为跨模态迁移三条黄金定律。

深度学习自然语言处理
新闻资讯7

米哈游一夜烧掉200万元Token,大厂高管也开始质疑:Token烧不出价值,但养肥了谁?

Uber运营负责人质疑AI tokenmaxxing成本合理性,米哈游员工一晚烧200万Token。部分公司开始调整,如邻国取消AI使用绩效评估,Shopify阻止失控消耗。Tokenmaxxing让模型厂商、编程工具和算力相关方受益,盲目跟风企业或成输家。

AI前线