「语言能力」共找到 4000 篇相关文章
8.6K star!!实时翻译、离线使用、支持50+语言,这个免费开源项目牛皮!
介绍开源项目RTranslator,它为Android平台实时翻译应用,用Meta的NLLB模型与OpenAI Whisper技术,本地处理保障质量与隐私。有双模式对话等功能,在Github获8.6K star。
LLM已能自我更新权重,自适应、知识整合能力大幅提升,AI醒了?
近期,AI自我演进话题研究讨论渐热。OpenAI奥特曼畅想AI自我改进未来,有爆料称其内部运行递归式自我改进AI。MIT论文提出SEAL框架让LLM自我更新权重,引发热议,实验显示其有提升但也有局限。
80%到25%逆转!大模型代码能力最新排名:Anthropic不再是唯一的神?
OpenRouter网站有模型使用排行榜,按不同使用场景分类。2024年12月到2025年2月,Anthropic模型编程流量占比曾达80%,后谷歌Gemini 2.5 Pro等抢占份额,其跌至25%以下,Claude 4发布后份额回升。还介绍了OpenRouter特点。
通义实验室新研究:大模型自己「扮演」搜索引擎,提升推理能力无需搜索API
阿里通义实验室开源ZeroSearch,提供无需与真实搜索引擎交互的强化学习框架。它用模拟搜索环境和渐进式抗噪训练,让LLM自给自足,节省API成本,在多问答数据集表现优,为智能化检索提供新思路。
紫东太初推出GMC核心集剪枝方法,少80%Token仍满血保真多模态能力
视觉Token冗余是多模态模型高效推理与落地的瓶颈,传统筛选方法有缺陷。紫东太初团队提出GMC核心集剪枝方法,具双阶段架构,优势多,实验显示其能在减少Token同时保持性能。
蚂蚁百灵新一代Ling-3.0开源,智效比13.2,124B释放1T能力
蚂蚁百灵新一代模型Ling-3.0开源,有flash和tiny两版本。Ling-3.0-flash参数量124B,智效比13.2,输出快成本低;Ling-3.0-tiny参数量7.9B,激活少且适用多场景,二者都极致挖掘模型效率。
DoorDash 如何打造了一款不完全依赖大型语言模型(LLM)的 AI 购物助手
DoorDash 分享对话式 AI 助手 Ask DoorDash 的架构,它借助 LLM、AI 代理等构建系统。测试显示其提升了结账转化率等指标,还构建自动评估框架改进质量衡量,架构分离协调与业务功能。
1.5B刷新数学代码SOTA!快手&清华精细化Token管理,LLM推理能力飙升
快手与清华团队用1.5B参数小模型在推理基准上超越同量级SOTA。其Archer方法通过精细化Token管理,对知识型和推理型Token差异化训练,让知识和推理同步更新且互不干扰,在数学和代码任务表现出色。
舍弃自回归,离散扩散语言模型如何演化?NUS综述解构技术图谱与应用前沿
本文介绍新加坡国立大学xML团队的论文,梳理离散扩散方向研究图谱,对比自回归局限与离散扩散优势,阐述数理基础、模型生态、训练与推理技术,还提及应用及未来方向,显示其对自回归范式的替代潜力。
AI 时代最大的“幻觉”:我们有了最强工具,却正在失去定义真问题的能力
BAT增长顾问、前快手产品总监杨一溪在全球产品经理大会指出,AI时代人们易迷失在‘可能性’中,失去定义‘真问题’的耐心。他结合案例,从多方面分享增长方法论,强调用户需求洞察的重要性。