「语义向量化」共找到 994 篇相关文章
GPT-5.1 突然发布,用户实测:更像 4o,情商大幅提升
OpenAI 向部分付费用户推送 GPT - 5.1,有即时思考和深度思考两种模式,系统自动匹配。它有八种人格预设,改进不仅在语气,还提升记忆编织等能力,像是补救 GPT - 5 失败,还扩展安全评估。
Nature重磅预警:ChatGPT切走教育主权,学生大脑或将重构?
AI正以“教育革命”之名占领全球校园,如清华新生用AI助理报到,加州州立大学接入ChatGPT Edu,Google向学生免费开放Gemini。但这悄悄重写权力格局,让教育主权面临挑战,引发诸多思考。
TinyAI :全栈式轻量级 AI 框架
TinyAI是用Java实现的全栈轻量级AI框架,具有教育友好、模块化等特点。它分层设计,涵盖数学运算、神经网络等模块,支持多种模型架构与并行训练,还有智能体系统,可用于多领域,未来规划丰富。
【DeepSeek-OCR系列第一篇】Language Modelling with Pixels【ICLR23】
当前主流语言模型依赖固定词表,扩展到多语言、多脚本时面临覆盖受限、计算昂贵、鲁棒性差等问题。ICLR 2023论文提出不依赖词表的PIXEL模型,通过将文本变成图像用视觉Transformer理解,实验验证其有跨语言、抗噪声等优势。
VAE再被补刀!清华快手SVG扩散模型亮相,训练提效6200%,生成提速3500%
前脚谢赛宁宣告VAE在图像生成领域退役,后脚清华与快手可灵团队就推出无VAE潜在扩散模型SVG。它通过语义+细节双分支+分布对齐,实现多任务通用,训练提效62倍、生成提速35倍。
Jina Reranker v3: 全新“列式”重排器,0.6B参数刷新文档检索SOTA
Jina AI推出第三代重排器Jina Reranker v3,在多语言检索基准上刷新SOTA。它参数仅6亿,有“last but not late”交互机制,能一次性处理查询和文档。还提供动态量化格式,方便不同硬件部署。
全新合成框架SOTA:强化学习当引擎,任务合成当燃料,蚂蚁港大联合出品
蚂蚁通用人工智能中心自然语言组联合香港大学自然语言组推出PromptCoT 2.0,押注任务合成。它让30B - A3B模型在数学代码推理任务达SOTA,全面升级效果、数据和方法,还将考虑多方向发展。
Anthropic 联创曝内部工程师已不写代码了,但工作量翻倍!开发者嘲讽:所以 Claude bug才那么多?
Anthropic联合创始人透露公司工程师已不写代码,通过管理AI Agent系统写代码,工作量达原来2 - 3倍,还提议向AI公司征税。但开发者质疑Claude存在诸多问题,认为AI写代码未到革命地步。
Scaling Law再现Agent领域!阿里提出训练新范式:在预训练和后训练之间还需一个Agentic CPT
近年来,大型语言模型向智能体系统进化。但当前主流方法构建智能体不佳,阿里通义实验室团队论文提出智能体持续预训练(Agentic CPT)新范式,开发AgentFounder模型,在多基准测试表现卓越。
Jina Code Embeddings: 为高质量代码搜索而生的0.5B/1.5B向量模型
本文介绍了 Jina AI 开源的代码向量模型 `jina-code-embeddings`,含 0.5B 和 1.5B 规模,有 GGUF 量化版本。它性能顶尖,支持多任务与 15 种语言,还介绍了训练方案、使用方法等。