「语言智能体」共找到 4329 篇相关文章
神隐许久的光年之外,造了款AI浏览器Tabbit,能打吗?
浏览器成AI落地重要战场,巨头纷纷布局。光年之外推出Tabbit AI浏览器,集多种功能于一体,深度融合AI能力,已开启公测。实测其功能实用,虽有不足但已改变使用习惯,AI浏览器或重塑人与信息关系。
千星项目LLMRouter:多模型路由,16+策略优化推理
UIUC开源智能模型路由框架LLMRouter,可自动为大模型应用选最优模型,有16+路由策略。该框架打通训练、评测等链路,解耦Route与Training模块,支持多轮协同等,还可插件式扩展。
大模型微调评测入门:看懂这些指标,才知道模型好不好
文章指出大模型微调中很多新手重“调”轻“评”,评测是决定模型落地的关键。介绍分类和生成任务评测指标,给出实操步骤,还说明如何综合判断模型好坏,最后展望评测技术朝自动化等方向发展。
从平面几何出发:形式化验证如何驱动MLLM的推理能力跃迁
多模态大语言模型在复杂数学与几何推理中有缺陷,现有训练方式让模型难有鲁棒推理能力。上海交大等团队提出“以形式化增强非形式化推理”方案,构建完整闭环,提升模型推理及泛化能力。
LLM规划能力飙升79%!Google:内在自我批评技术拿下多项SOTA
Google DeepMind研究《通过内在自我批评提升大语言模型的规划能力》,不借助外部验证器,让LLM反复“自评+重写”,使Blocksworld准确率从49.8%升至89.3%,还介绍了方法及跨模型验证情况。
LLM时代的事件抽取:从静态任务到认知脚手架
此综述论文探讨LLM时代事件抽取价值,认为其未被削弱,应视为“认知脚手架”。它系统梳理任务分类、方法演进等,还提出六大未来研究方向,指向将其演化为智能感知与记忆层。
100万辆“斩杀线”出现,2026年中国智驾进入淘汰赛|甲子光年
2025年中国智能驾驶行业进入规模与交付主导阶段,100万辆成为2026年智驾行业‘斩杀线’。华为已跨过‘安全区’,地平线、卓驭等构成一线梯队。毫末智行等公司因技术与交付问题出局,行业竞争更残酷。
奥特曼点名「AGI最后一块拼图」!记忆,才是硅谷2026新共识
2026年,AI竞争焦点从Scaling转向记忆。奥特曼押注记忆,预计ChatGPT产品线未来一年有进展。AI记忆能力成新共识,提升其记忆成巨头竞争核心,不过距完善记忆系统还远。
Wispr Flow 平替, 这款开源中文语音助手,程序员真该试试,本地离线的中文语音输入神器来了(开源白嫖版)
蛐蛐(QuQu)是开源桌面应用,用本地语音识别模型和配置的大语言模型,将语音实时转文字并润色。它主打本地语音工作流,替代Wispr Flow,免月费且保护隐私,适合中文用户。
刚刚开源就爆火,轻量快速,GB 大文件都秒开!
文章介绍刚开源就爆火的文本编辑器Fresh,它基于Rust语言,目标轻量、快速、功能强大,支持多平台。有上手0门槛、轻量快速等特性,还给出多平台安装方式和基本使用方法,值得开发者尝试。