新技能」共找到 3840 篇相关文章

算法论文8

大模型破译甲骨文创下SOTA!复旦团队推出框架

复旦大学团队提出基于部首和象形分析的可解释甲骨文破译框架,构建PD - OBS数据集。该框架在公开基准数据集上准确率高,零样本破译能力强,能输出可解释分析文本,助力考古破译。

量子位
算法论文8

大模型破译甲骨文创下SOTA!复旦团队推出框架

复旦大学团队提出基于部首和象形分析的可解释甲骨文破译框架,构建PD - OBS数据集。该框架在公开基准数据集上准确率高,零样本破译能力强,还能为未破译甲骨文输出可解释分析文本,助力考古工作。

量子位
开源动态8

DeepSeek开源模型,提出上下文光学压缩:LLM的记忆方式

DeepSeek开源OCR模型,探索用多少视觉信息让LLM理解文本。实验表明1000字文档约需100个vision tokens,压缩比10倍、准确率97%。还提出模拟人类遗忘等想法,有多种应用场景,且完全开源。

花叔
算法论文8

长程任务飙升98%,斯坦福Skill原生LLM来了

普林斯顿、CMU、斯坦福、牛津等提出Skill-Native大模型,提出Skill Entropy度量技能切换难度,搭建Skill²-Bench评测,还将熵用作训练信号提出Skill-Entropy RL,提升多模型准确率,且技能熵可复用。

PaperAgent
算法论文8

谷歌Transformer过时了?清华姚班校友等三连击,爆改注意力!

谷歌提出架构,参数减少40%,训练速度较RNN提升5 - 8倍,某些任务性能超Transformer 7.2%。架构引入注意力偏向策略,用「保留」取代「遗忘」,还提出Moneta、Yaad、Memora三个模型,在多任务上表现卓越。

新智元
产品应用7

米哈游蔡浩宇,发了个“游戏版ChatGPT”

米哈游蔡浩宇上AI聊天软件AnuNeko,用户反馈其人性化高但逻辑较弱。AnuNeko出自蔡浩宇公司Anuttacon,该公司此前还推出实验性AI游戏。如今AI+游戏大势所趋,米哈游游也加入更多AI元素。

量子位
算法论文8

一篇19种自进化Agent Skill框架最综述

这篇来自Rutgers大学和UNC Charlotte的survey,首次系统梳理Agent技能的进化与评估全貌,覆盖19种技能进化方法和10个评估基准。指出当前评估体系有诸多不足,如无法追踪技能多轮反馈后是否变好等。

PaperAgent
产品应用7

Chaterm Agent Skills + 千问大模型,智能运维再进化

文章介绍Chaterm Agent Skills与千问大模型结合用于智能运维。它能将运维经验打包成技能,提供三种模式,缩短运维时间。文中还阐述了技能概念、工作原理、技术实现及实战案例,鼓励用户尝试创建技能

阿里云开发者
新闻资讯7

H-1B正在筛掉「下一个英伟达」?

美国政府公布H-1B签证规,将申请费用提至10万美元,还提高工资门槛。英伟达CEO黄仁勋支持但担忧,认为费用或抑制初创企业、削弱美对人才吸引力,也有教授反对规。

新智元
新闻资讯8

内容娱乐风向:这群创业者靠多模态 AI 玩出了花样

12月23日,「MASHANG DEMO TO DAILY」第二期活动在杭州开启,展示多模态AI探索成果。6位创业者分享精华内容,涉及游戏开发、虚拟社区、视频创作等领域,探讨多模态AI产品价值与发展方向。

特工宇宙