「结构化文本」共找到 1540 篇相关文章
华为乾崑 all in 启境,开启造车新模式
在华为乾崑生态大会上,启境给出了自己的答案。华为不仅技术赋能启境,还将团队、流程与之深度融合。启境目标是打造不妥协产品,成为‘六边形战士’,其愿景是塑造‘移动智能体’。
Meta通过简单算术解锁LLM SoTA性能
大型语言模型训练耗算力与时间,传统模型融合方法有局限。本文提出SoCE新方法,通过筛选专家模型、非均匀加权平均融合,在多评测中实现先进性能,为LLM优化提供新思路。
Meta开源多语言语音识别系统,支持1600种语言,可轻松扩展新语种!
Meta研究团队开源Omnilingual ASR,能理解1600种语言,用几条语音 - 文本配对样本就能零样本扩展新语种。提供三种架构,满足不同需求,性能超现有多语种模型,应用场景广泛。
在失败中进化?UIUC联合斯坦福、AMD实现智能体「从错误中成长」
伊利诺伊大学厄巴纳 - 香槟分校等团队发布论文,剖析LLM智能体失败机制,提出可自我修复的创新框架AgentDebug。研究指出智能体常见失败类型,构建错误分析体系、数据集,实验显示该框架效果显著,为AI可靠性提供方案。
华为Doc-Researcher 布局感知+视觉语义双杀
现有深度研究系统依赖文本网页数据,忽视多模态文档知识。华为Doc - Researcher系统解决多模态文档解析不足、检索策略有限、缺乏深度研究能力等问题,含多模块,能处理复杂多模态任务。
NIPS2025 | A-Mem让Agent拥有动态自我记忆功能,达到新SoTA
近年来,LLM代理需长期内存系统,但现有系统缺乏灵活性。论文提出A - Mem能动内存系统,受Zettelkasten启发,能让记忆‘自我整理’和‘自我更新’,在多基准测试领先,也指出了局限性和未来方向。
Github 3.6k star,爆火开源「小红书 MCP」:一键登录、图文发布、搜索、评论全搞定
`xiaohongshu-mcp`把浏览器手工步骤封装成可编排工具,以Go编写,能在无头/有界面模式间切换。它解决小红书运营多痛点,如登录不稳、发帖链路长等,覆盖登录、发帖等全链路,适配多客户端,值得收藏上手。
从BM25到Multi-Vector:6种Embedding演进路线
文章介绍6种Embedding演进路线,包括Sparse、Dense等,分析其特点、痛点、效果和案例,还给出选型建议,如关键词匹配选Sparse,长文本定位选Multi - Vector,也提及方案选择步骤。
过时的 Python 版本会让公司损失数百万美元
JetBrains报告显示83%的Python开发者用旧版本,这不仅是技术债务问题,还会增加云账单成本。Python新版本有显著性能提升,升级能节省成本,容器化也未加速升级。
奥特曼砍掉GPT-4o引爆AI「戒断反应」,马斯克官宣Grok 4全球免费!
奥特曼在发布GPT - 5时砍掉旧模型引网友不满,他认为要防止用户对AI成瘾,让产品利大于弊;马斯克则官宣Grok 4全球免费,用热辣模式等吸引用户,形成上瘾曲线。