大模型进化」共找到 9536 篇相关文章

开源动态8

谷歌推出 LLM-Evalkit,为提示词工程带来秩序与可衡量性

谷歌推出基于 Vertex AI SDK 的开源框架 LLM - Evalkit,让语言模型提示词工程更有序可衡量。它整合实验、测试等环节,与谷歌云工作流集成,有无代码界面,已在 GitHub 发布。

AI前线
算法论文8

社交Agent: 通过RL学习自适应Thinking,根据场景在“秒回”和“深思”间灵活切换

现有聊天机器人在人情世故场景表现不佳,论文指出模型思维‘一根筋’。研究团队设计4种思维模式,用AMPO强化学习算法动态切换。在模拟社交任务中,AMPO表现超GPT - 4,省时高效。

深度学习自然语言处理
推荐文章8

如何正确Vibe Coding?这是来自Anthropic编程智能体负责人的师课

Anthropic研究员Erik Schluntz分享Vibe Coding经验。他认为AI能力指数级增长,开发者应接纳模型生成系统,还提出聚焦‘叶子节点’、做好产品经理等策略,并介绍22000行代码合并案例及实战问答。

机器之心
开源动态7

美团开源Agentic新王,速度拉满,工具调用打爆Kimi?

周末美团开源LongCat - Flash模型,参数量560B,推理速度达100 token/s,成本低,在Agent工具调用表现超Kimi - K2。它有Zero - Computation Experts和ScMoE创新,不过市场表现未获太多认可。

探索AGI
开源动态7

JManus - 面向 Java 开发者的开源通用智能体

在Manus火热背景下,Spring AI Alibaba JManus诞生,它是用Java实现的开源OpenManus。可集成多个模型,功能完善,能让Java开发者低门槛搭建智能体系统,还给出了运行方法及共建思路。

阿里云开发者
新闻资讯7

月薪3万,去内蒙草原给DeepSeek守机房

深度求索放出数据中心高级运维工程师等岗位,要将效率至上哲学从软件延伸到机房运营。其选择乌兰察布建数据中心,因当地条件优、产业生态成熟。且传闻其新一代模型V4将发布,算力成决胜关键。

量子位
算法论文8

钉钉DeepResearch, 0.008元/1k Token击穿地板价

阿里为7.5亿钉钉用户推出Dingtalk - DeepResearch,解决企业办公AI化痛点。系统采用“三横一纵”架构,有多阶段强化学习等三种解法及DingAutoEvaluator纵向飞轮,实现模型进化、自纠错。

CourseAI
算法论文8

仅用1/9的token拿下SOTA,用LLM当知识路由:全新RAG框架DeepSieve

语言模型遇「最新」或「垂直领域」知识易出错,传统RAG做法有痛点。全新RAG框架DeepSieve把LLM当知识路由器,四步筛选信息,实验精度高、成本低,消融实验明确各模块价值,还有救场案例。

PaperAgent
新闻资讯7

并行革命,32倍吞吐量跃升!英伟达Helix架构突破百万Token推理瓶颈

英伟达推出受DNA结构启发的Helix并行技术,能解决模型处理长任务时的卡顿问题,提升上下文长度、并发能力并降低响应延迟。不过也有人认为其技术与实用性有差距。

新智元
新闻资讯8

万字长文梳理「罗福莉」三个半小时的访谈:2026年不是Agent元年,是生产力爆发年

小米模型负责人罗福莉在访谈中复盘技术剧变,分享对OpenClaw的认知转变,阐述Agent框架本质,介绍MiMo V2架构选择,探讨人跟Agent共创、多模态Agent等内容,判断2026年生产力将爆发。

开源AI项目落地