推理语言模型」共找到 8333 篇相关文章

产品应用8

将导游装在口袋里:AI 对景区游览新赋能

同程旅行研发的“同程伴游”AI助理,能为景区游客答疑解惑,实现原生数字化导览。它可按需讲解、避免走回头路,还能生成数字旅行日记。其基于高精度定位和大语言模型,未来还将持续升级。

AI前线
算法论文8

上交、清华、微软、上海AI Lab等联合发布数据分析智能体综述,LLM化身数据分析师,让数据自己「说话」

传统数据分析方法耦合度高、扩展性差,大语言模型与智能体让数据分析迈向“语义理解”。上交、清华等机构联合撰写综述,回顾演进,提出新范式,总结关键技术、趋势及挑战,推动通用数据分析智能体发展。

机器之心
开源动态7

Qwen3.8-27B 登顶全球开源榜第一,曾经的「源神」又回来了!

8月17日,阿里发布的Qwen3.8 - 27B成Hugging Face热门第一。它以27B参数在部分测试中与前沿闭源模型比肩,可本地运行。不过推理慢、真实任务表现待提升,它让前沿Agent能力下放到个人电脑。

AI科技评论
推荐文章8

吴恩达年终总结:2025是AI工业时代的黎明

吴恩达发表2025人工智能年度总结与公开信。总结指出,今年推理模型性能提升但有成本,AI人才争夺激烈、薪酬高,数据中心建设投入大,智能体让编程更高效。信中建议通过学课程、动手实践和读论文构建AI系统。

机器之心
8

ICML 2026 开幕,清华团队获最佳论文奖,DeepMind 经典巨作拿下时间检验奖

2026年7月6日,第43届国际机器学习大会(ICML 2026)在韩国首尔开幕,投稿规模与录用总数破纪录。会上,清华黄高团队论文获杰出论文奖,指出扩散语言模型“灵活性陷阱”;还有多篇论文获荣誉提名,另有立场论文、时间检验奖等揭晓。

AI科技评论
算法论文8

无损减少80%激活值内存,提升5倍训练序列长度,仅需两行代码

港中文(深圳)和上海交通大学团队提出 StreamBP 算法,通过线性分解和分步计算,将大语言模型训练激活值内存降至梯度检查点的 20%,在相同内存下最大序列长度为其 2.8 - 5.5 倍,代码已开源。

机器之心
产品应用7

这才叫AI原生应用:Google Slides

Google Slides是Google版AI PPT,与传统AI PPT不同。它像传统PPT搭配AI聊天机器人,用Nano Banana模型可直接生成图片和文字,能像素级推理,打破传统PPT结构,还可自然语言交互修改,只是中文生成效果待提升。

newtype AI
产品应用7

实测DeepSeek V3.1,不止拓展上下文长度

文章实测了DeepSeek V3.1和V3,发现V3.1在编程、写作、翻译等方面有变化,如编程更全面、写作风格变文艺等。网友测试其在aider得分71.6%成非推理模型SOTA,但线上API有问题。

量子位
算法论文8

工具增强的多模态LLM综述

多模态大语言模型(如GPT - 4V)虽有强大图文理解能力,但受数据稀缺、复杂任务表现不佳和评估标准不统一限制。论文提出为MLLM集成外部工具,构建全景图,覆盖多维度,还指出挑战与对策。

深度学习自然语言处理
算法论文8

Temperature Scaling可大幅提高Test-Time Scaling瓶颈!

大型语言模型解决复杂推理问题时,测试时扩展(TTS)是提升性能的途径之一。但传统TTS依赖增加样本数量,性能提升有瓶颈。本文提出温度缩放新思路,实验表明其能大幅提升性能,还给出降低成本方法。

深度学习自然语言处理