「通用文本嵌入」共找到 1296 篇相关文章
Claude版Manus只用10天搓出,代码全AI写的!网友:小扎140亿并购像冤大头
Claude Cowork是面向工作场景的通用智能体,基于Anthropic自研模型打造。开发约10天,代码全由Claude Code写,人类仅负责规划等。它让非编程用户能用AI能力,这让扎克伯格20亿买Manus的操作显得冤。
大模型如何泛化出多智能体推理能力?清华提出策略游戏自博弈方案MARSHAL
近日,清华大学等机构研究团队提出 MARSHAL 框架,利用强化学习让大模型在策略游戏自博弈。实验表明,多轮、多智能体训练提升了模型博弈决策水平,将推理能力泛化到通用多智能体系统,在一般推理任务表现显著提升。
救命!和漫画角色聊上头了,AI陪伴的新答案有了
快看漫画2.0版本推出AI陪伴互动漫画,将AI嵌入漫画角色,玩家以第一视角改写故事。它解决了AI陪伴产品痛点,靠共同经历和叙事上下文存续关系,还集成多家AI技术,内测数据显示有商业潜力。
黄仁勋手撕「AI泡沫」论!英伟达570亿铁拳暴击,显卡全断货
英伟达Q3 2026财报显示单季度营收达570亿美元,数据中心业务同比狂涨66%。黄仁勋称AI不是泡沫,而是计算范式从通用CPU转向加速式GPU计算的必然。当前多数AI公司估值高、收入低,英伟达作为‘卖铲人’大获全胜。
小扎新AI,凉得彻底?
9月25日,Meta推出嵌入Meta AI应用的AI视频流Vibes,可浏览、二创和分享AI视频,改写短视频玩法。它降低创作门槛,融入Meta生态,野心勃勃,但也带来版权等争议,还将与硬件结合,AI视频或成新全民入口。
AI已迷失方向?强化学习教父Sutton最新发布OaK架构,挑战当前AI范式,提出超级智能新构想
强化学习教父理查德·萨顿认为人工智能发展已迷失方向,提出OaK架构回应探寻真正智能的需求。该架构是基于模型的强化学习架构,具备组件持续学习等特点,为通用人工智能指明路径,但面临持续学习和特征生成挑战。
解决扩散模型过拟合的创新框架T-LoRA
预训练大型文本到图像扩散模型定制化时,样本有限易致过拟合。AIRI和HSE大学团队提出T - LoRA框架,动态调整训练能力、用正交初始化,实验显示其在单图像和多图像任务表现优,用户更偏好其生成图像。
一文看懂“提示词” vs “提示词工程” vs “上下文工程”
文章区分了提示词、提示词工程和上下文工程的概念。提示词是给AI模型的输入文本;提示词工程是设计、测试、优化提示词的过程;上下文工程是为大模型构建动态上下文的学科,在AI Agent背景下诞生。
太逼真!豆包·播客模型来了:一句话生成「苏超联赛」播客,很懂13太保的梗
火山引擎发布豆包·播客模型,生成的AI对话语气、停顿等像真人。操作简单,生成快且有字幕。能处理多种类型内容,如热搜话题、苏超联赛、超长文本等。其基于端到端实时语音模型,有技术突破。
200行python代码实现从Bigram模型到LLM
本文从`babygpt_v1.py`出发,逐步加入self-attention机制、position嵌入等,实现完整GPT。介绍Transformer结构,讲解位置编码、单头自注意力等机制的代码实现,还阐述后续层的用途、参数调整及训练效果,最后提及模型优化方向。