「多语言处理」共找到 5478 篇相关文章
陶哲轩联手AI挑战经典ε-δ极限!加法秒杀、乘法翻车
数学大师陶哲轩第三支Lean 4自动化数学证明视频,携手GitHub Copilot挑战「ε - δ」极限问题。Copilot处理加法较顺,减法卡壳,乘法失控。复杂证明时它短板尽显,陶哲轩认为复杂证明还得靠人脑。
叶子豪、陈天奇等人开源项目FlashInfer入选,MLSys2025最佳论文奖公布
近日,MLSys 2025公布最佳论文奖,FlashInfer等入选。FlashInfer由多机构合作发起,是灵活的LLM推理内核库,优化内存访问、有可定制模板和调度机制,性能提升显著。另一获奖论文提出Negativa - ML可消除ML框架臃肿。
追忆左耳朵耗子
本文追忆技术人左耳朵耗子,讲述其创业故事,包括创业契机、方向选择等,还分享技术见解,如选技术语言、积累技术等,探讨成长问题,如996、大小公司权衡等,最后推荐书籍并谈对年龄危机看法。
RL训练总崩溃?R1-Reward稳定解锁奖励模型Long-Cot推理能力
多模态奖励模型对提升多模态大语言模型表现至关重要,但强化学习在奖励建模应用有挑战。快手等团队提出R1 - Reward,解决训练不稳定等问题,在基准上超SOTA模型,还在快手业务场景成功应用。
17000字Claude 系统提示启示:Karpathy 揭秘LLM 学习缺失“第三范式”
Andrej Karpathy提出LLM学习范式缺失‘系统提示词学习’环节。他观察Claude约17000词的系统提示词,认为目前问题解决策略多靠人工写入,理想情况应通过该学习产生,这也引出诸多待明确细节和新问题。
无需训练!让VLM同时具备「视觉」与「推理」能力,数学题得分暴涨30%
当前视觉语言模型(VLM)像‘视力好但数学差的学生’,论文指出问题根源是数据不足和能力分布不均。提出‘模型合并’方案,实验显示在数学基准测试中表现亮眼,还通过实验揭示层间能力分布。
超越DeepSeek-R1,英伟达开源新王登顶!14万H100小时训练细节全曝光
英伟达Llama - Nemotron系列模型超越DeepSeek - R1且全部开源。论文揭秘其训练关键,如用合成数据监督微调与强化学习等。还介绍构建阶段、架构设计等,评估显示该系列模型在多任务表现出色。
红杉、云启领投,华超神控完成2亿元Pre-A轮融资,押注「非侵入式AI脑机接口」
本文报道初创公司华超神控完成红杉中国、云启资本领投的2亿元Pre-A轮融资,累计融资近3亿元,介绍其非侵入式AI脑机接口技术路线、研发进展与商业化规划,收录多位投资方观点。
DeepSeek Harness背后的“心脏”:Cordis 到底是什么
文章介绍Cordis框架,它原服务第三方QQ机器人,现是DeepSeek Harness心脏。阐述其设计初衷、核心机制,如插件、上下文等概念,还提及在DSH中的应用,展示了插件槽位和生态,最后介绍相关论文和该框架的生态情况。
2026夏季崇礼论坛五大看点,AI如何走进生活|甲子光年
2026年9月12 - 13日,2026夏季崇礼论坛将在崇礼·太舞小镇举行,主题为“未来此刻”。有五大看点,包括俞敏洪等探讨AI能力与入口,揭晓“AI NEXT 20”榜单,多场硬件、内容等相关圆桌及产品展示。