「大模型技术」共找到 10572 篇相关文章
GEAClaw 来了:企业级“OpenClaw”,一只有商业头脑的龙虾
文章指出当前大语言模型解决问题多为收敛式,与商业问题需先发散再收敛的方式相悖。特赞发布企业级智能体系统GEA,其架构四层分工明确,能在市场洞察、社媒增长等场景发挥作用。
什么样的龙虾,才是「一人公司」的心头好?
AI时代,OPC概念火热,但过往大模型和Agent难落地。面壁智能官宣EdgeClaw Box,采用端云两栖架构,安全高效,适配多款硬件,可插电即用,还能降成本、保障数据安全,集成多种Skills,助力OPC提效。
上海一群青年,造了个学术版OpenClaw
上海科学智能研究院联合复旦大学发布超级科研合伙人“大圣”,它是面向科学探索的高能动性智能体。能在生命、地球、人文等多领域发挥作用,其研发涉及多模态模型、群体记忆架构等核心技术,还介绍了相关赛事。
VL-LN Bench:模拟「边走边问找具体目标」的真实导航场景
上海人工智能实验室等研究者完成VL - LN Bench,模拟真实导航场景。它构建自动化数据收集管线,依托InternVLA - N1训练评测。结果显示主动对话可提升表现,但当前方法在实例感知对齐等环节有短板。
阿里云百炼 AgentScope 基于容器服务的最佳实践,加速企业 AI Agent 应用落地
自 ChatGPT 发布,大语言模型成智能系统核心,AI Agent 兴起。阿里云百炼与容器服务联合发布 AgentScope on 容器服务方案,为智能体应用提供运行底座,介绍了 AgentScope 特性、容器服务能力及部署实践等。
ChatGPT开始搞社交了
谷歌狂放大招,ChatGPT更新群聊功能,与微信、QQ群聊神似,还能让聊天机器人判断群气氛决定发言。不久前奥特曼称不做社交,此次更新被指仓促,未直击痛点、缺乏技术突破。
TinyAI :全栈式轻量级 AI 框架
TinyAI是用Java实现的全栈轻量级AI框架,具有教育友好、模块化等特点。它分层设计,涵盖数学运算、神经网络等模块,支持多种模型架构与并行训练,还有智能体系统,可用于多领域,未来规划丰富。
GraphRAG圈新秀:文档级RAKG
随着大模型能力增强,知识图谱成研究热点。传统KGC有实体消歧难、模式僵化等痛点。文章提出RAKG框架,将RAG评估机制引入知识图谱构建,实现文档级自动化构建与评估,多指标表现优异。
快手Klear团队提出CE-GPPO:通过梯度保留协调熵,解决强化学习中的熵不稳定问题
快手 Klear 语言大模型团队提出新强化学习算法 CE - GPPO,以「熵」为核心,提出梯度保留策略,重新利用裁剪外区间低概率 token 的梯度,实现策略熵的精细调控,解决强化学习中熵不稳定问题。
Vision-Zero:零数据VLM自我进化!陈怡然团队提出零监督训练新范式
陈怡然团队提出零监督训练新范式Vision-Zero,在多模态任务表现突出。它借鉴自博弈技术,设计自博弈框架,解决数据稀缺和知识天花板问题,还缓解跨能力负迁移,开源代码与模型可供研究。