简单任务」共找到 2346 篇相关文章

推荐文章7

Transformer | 一文带你了解Embedding(从传统嵌入方法到大模型Embedding)

文章介绍Embedding基础知识,从传统统计方法到如今大模型用例演变过程。涵盖传统、静态、上下文及大模型Embedding技术,如TF - IDF、word2vec、BERT等,还剖析DS - Qwen1.5B的Embedding并以图展示。

AINLPer
新闻资讯7

今天起全员免费!GPT-4.1上线ChatGPT,首波实测:又快又听话,油腻感没了

今天凌晨起,GPT - 4.1可在ChatGPT中供所有用户使用。它专为编码任务和指令执行设计,推理效率高。首波实测反馈速度快、需明确指示且更清爽,性价比高,是日常编码的好选择。

量子位
算法论文8

TreeHop:无需LLM的高效多跳问答新范式

多跳问答(MHQA)任务有挑战,现有方法依赖LLM,计算成本高、延迟显著。TreeHop研究提出新方案,摒弃LLM,通过嵌入空间动态更新,降低延迟、减少模型参数量,还在主流数据集表现佳,适合工业应用。

深度学习自然语言处理
开源动态8

纯血国产!4B模型越级打怪,杀入万亿赛道

9月1日,Hugging Face上线星火X2.5-4B和1.7B开源端侧模型,在多指标测试中表现优异,实现“越级打怪”。该模型基于全国产算力平台训练,在断网笔记本上实测效果惊艳,使用了两项技术提升能力,适配性强。

新智元
开源动态8

一款永远不睡觉的 AI Agent 微框架:它会自己琢磨事儿,干完主动来找你汇报!

Laude Institute的AI Agent Audel在无指令下自动修复bug,背后是开源的AI Agent微框架Headlong。它与其他Agent不同,其Agent永远不睡觉,核心由9800行Bash脚本构成,安装简单,提出AI主体性问题。

开源星探
新闻资讯7

撞名Anthropic的“外挂”刷屏:让“DeepSeek V4‑Pro碾压 Fable 5”但无人能复现,Token开销反而翻倍

J - Space Cognition Suite社区项目在X上传播,称不修改DeepSeek V4 - Pro模型权重,用推理时Harness能提升其在多项Agent Benchmark表现,超Fable 5,但未第三方复现,且Token开销可能翻倍。

InfoQ
算法论文8

Auto-Research「终极大考」:新基准撕下大模型科研伪装

来自多所高校的研究者提出MLS - Bench,用于解决现有Auto - Research评测的归因问题。它含140个真实研究任务,校准受控修改范围,主实验显示当前模型在方法发现上有明显缺口,Auto - Research需更严格评测标准。

机器之心
8

浙大开源HugAgentOS:三引擎一体自进化,每步可归因/回放/回滚

过去一年,Agent任务执行能力提升,但不会自主积累与进化。浙大开源的HugAgentOS把Harness拆成三个可自我成长的引擎,设归因和本体两道关卡,解决经验成能力等问题,还覆盖智能体完整链路。

新智元
推荐文章7

自构建智能体:一项 LangChain4j 实验

作者将LangChain4j文档交代码助手,让其参照构建智能体,设计多智能体系统编写、测试和调试代码。实验展示了LangChain4j优势,还对比监督者和工作流两种智能体实现模式,揭示速度与自主性权衡关系。

InfoQ
推荐文章7

为什么堆算力救不了大模型

文章指出大模型和人类大脑归纳规律路径不同,AI追求精确但脆弱的拟合,人追求粗糙但不变的压缩。大模型在可收敛系统表现惊艳,不可收敛系统则崩盘,未来AI产品核心是打造可收敛封闭环境。

AI科技评论