「多语言翻译」共找到 4906 篇相关文章
量化噪声竟是RL秘钥?QeRL:高效强化学习新范式,一场噪声引发的性能革命
近年来,大语言模型在复杂推理任务中面临挑战,强化学习虽更接近人类推理过程,但训练“烧资源”。论文《QeRL》提出量化不仅能压缩模型、节省资源,还能增强模型探索能力,QeRL框架实现训练速度提升、内存占用减半。
前Meta大神创业,用强化学习打造PokeeResearch-7B模型,刷新AI深度研究SOTA
Pokee AI发论文介绍70亿参数的PokeeResearch - 7B模型,用基于AI反馈的强化学习和推理框架,在深度研究基准测试中成绩领先。该公司由前Meta大神创立,产品可打通多应用,已获融资并公开测试。
万亿级思考模型,蚂蚁首次开源!20万亿token搅局开源AI
10月14日蚂蚁集团发布万亿参数思考模型Ring-1T,在多领域表现出色,推理能力直逼闭源巨头。此前已开源旗舰通用大模型Ling-1T。还介绍了训练技术创新,虽模型有不足,但开源夺冠证明‘思考力’可工程化。
只需1/4预算,性能反超基线:阿里高德提出Tree-GRPO,高效破解智能体RL难题
阿里高德提出Tree - GRPO方法解决智能体RL难题。它以智能体步骤为节点树搜索,在11个数据集中更省预算、表现更好,能在1/4预算超GRPO基线,解决了Rollout成本高和监督稀疏问题。
就在刚刚,ChatGPT发布了一个新功能Pulse
北京时间凌晨,山姆·奥特曼宣布 OpenAI 为 Pro 用户上线 ChatGPT Pulse 预览版,后续会扩展到 Plus 用户及所有人。Pulse 核心是主动推送个性化更新,能结合多信息生成内容,但需用户开放大量个人数据,隐私问题值得关注。
秘塔AI放大招!「边想边搜边做」,内置20+智能体,想法一键实现
在AI浪潮下,搜索正经历重构。秘塔AI推出「Agentic Search」模式,「边想边搜边做」,可自主完成多步工具调用,内置20余种工具。通过5个场景展示升级,从读懂用户到美化结果、精准计算、打通工作流等,让搜索进化为「帮达成」。
2万开源项目已用上,OpenAI下了盘大棋,Cursor,Codex智能体纷纷支持
据彭博社消息,DeepSeek计划年底发布可自主执行多步任务、自我学习进化的AI Agent。OpenAI开源的AGENTS.md已获5k星,为编码智能体提供使用说明,还给出示例和使用指南,相关智能体已用于2万开源项目。
将 AI 注入 Java 应用程序
文章围绕将 AI 注入 Java 应用程序展开,以宇宙飞船租赁应用的聊天机器人为例,介绍如何用 LangChain4j 和 Quarkus 等 Java 框架与大语言模型(LLM)交互,还提及流式响应、结构化输出等功能及相关概念。
手机“自动驾驶”时代来了,智谱还让手机拥有“云替身”
作者参加智谱AutoGLM新版本闭门会并试用,该版本亮点多,如成全球首个手机通用Agent,操作在云设备运行,全平台覆盖等。云手机Agent能力稳定高效,能处理多类任务,还可助老人等群体用手机。
Meta没做的,英伟达做了!全新架构吞吐量狂飙6倍,20万亿Token训练
英伟达发布全新架构9B模型NVIDIA Nemotron Nano 2,以Mamba - Transformer混合架构实现推理吞吐量最高提升6倍,对标Qwen3 - 8B并在多任务中表现持平或更优,还开源模型及大部分预训练数据。