「按结果付费」共找到 916 篇相关文章
LLM的RL训练轨迹竟然是线性的?Miaow Lab|新工作:无需继续训练,直接“预测”未来模型!
文章介绍《Not All Steps are Informative: On the Linearity of LLMs' RLVR Training》,揭示RLVR训练中LLM权重和输出概率线性变化,提出“权重外推”法,可实现6.1倍训练加速,还介绍三种策略及实验结果。
SGLang-Diffusion: 两个月进展
自2025年11月初发布,SGLang - Diffusion获广泛关注。过去两月持续优化,速度提升1.5倍。介绍新模型支持、LoRA支持等进展,还展示性能测试结果,阐述关键改进及未来规划。
DeepSeek-OCR是「长文本理解」未来方向?中科院新基准VTCBench给出答案
DeepSeek - OCR的VTC技术可实现高压缩率,降低长文本处理成本。但视觉语言模型能否理解压缩信息存疑,中科院等推出VTCBench评估,测试模型认知极限,还推出VTCBench - Wild检测鲁棒性。
BellSoft 发布 Java 加固镜像
BellSoft 在 KubeCon 2025 大会发布新的“加固镜像”产品,集 Java 运行时优化、操作系统加固与主动 CVE 修复于一体,可减少已知漏洞、降低资源消耗,还提供 SBOM 满足合规需求。
GPT-5-Thinking新训练方法公开:让AI学会忏悔
OpenAI提出忏悔训练Confessions,让ChatGPT自己“坦白从宽”。在GPT - 5 - Thinking上实验有效,模型犯错后多会坦白,且更诚实,不影响原任务表现。还介绍了训练方法、实验结果及局限性。
百亿美金独角兽的 AI 革命:效率提升 10 倍,COO 和 CTO 联手,彻底改造工作流
本文介绍金融科技独角兽 Brex 的 AI 革命。其 AI 战略分四部分,CTO 和 COO 联手推进。公司把内部 AI 平台当产品,重构工作流,招聘转向通才,还给出工作流优先级标准,预计运营效率提 5 - 10 倍。
Sora 2 App 上手体验攻略,附Sora AI视频
本文是Sora 2 App上手体验攻略。Sora 2 PC版能依提示词生成精美电影感视频,还可创建虚拟形象;App交互似抖音,能录制上传自身形象生成视频。其生成视频镜头自然,有“AI导演感”,但目前时长较短。
ICLR神秘论文曝光!SAM3用「概念」看世界,重构视觉AI新范式
2023年Meta推出SAM,后SAM 2扩展到视频分割。近日,SAM 3现身ICLR 2026盲审论文,带来「基于概念的分割」新范式,强调按「语义概念」理解和分割图像,还构建数据引擎提升性能。
开发者狂喜:Thinking Machines发布首款产品Tinker,后训练麻烦全给包了
OpenAI前CTO创办的Thinking Machines推出首款产品Tinker,这是用于微调语言模型的API,能简化LLM后训练过程,支持前沿模型,使用LoRA技术降低成本,还发布开源库,多高校团队已试用。
麻省理工AI放王炸!无需说话、秒懂你的想法,外挂AI大脑来了
今天凌晨2点,麻省理工学院分享突破性研究Alterego。它是可穿戴无声语音交互AI设备,通过捕捉神经肌肉信号实现无声沟通,处理后用骨传导耳机反馈结果,应用场景广泛,还能帮助残疾人交流。