测试时训练」共找到 3996 篇相关文章

新闻资讯7

Anthropic 技术栈里的「五宗罪」由何而来?

Anthropic的Claude模型升级后,用户却觉得不好用。X上帖子指出其存在文本和代码标记、模型能力、定价、长上下文等问题,这些问题卡在生成、计算、上下文和Agent运行的5个具体位置,导致各方面互相拖后腿。

AI科技评论
新闻资讯7

ChatGPT的第一块广告位,被谁买走了?OpenAI:别骂,我们这次所有底线都招了

OpenAI宣布将在ChatGPT测试广告,以标注“赞助”链接形式出现在回答底部,不影响回答内容。广告仅对免费版和Go套餐用户展示,OpenAI称广告收入占比将低于总收入一半,还说明了广告原则等情况。

AI前线
开源动态8

突破具身智能任务规划边界,刷新具身大脑多榜单SOTA,中兴EmbodiedBrain模型让具身大脑学会「复杂规划」

当前主流大语言模型在具身任务场景面临瓶颈,中兴星云大脑团队推出具身视觉 - 语言基础模型 EmbodiedBrain,构建全流程创新框架,在架构、数据训练、评估体系等方面有突破,还将开源成果推动生态发展。

机器之心
新闻资讯7

OpenAI发布GPT-5.1 Codex Max,编程能力比Gemini 3更强、更持久

为换回注意力,OpenAI紧急发布GPT - 5.1 Codex Max。它在编程测试中表现优于Gemini 3 Pro,还实现24小项目级开发。引入自动压缩与扩展推理改进,效率提升,现已多途径可用,API访问将开放。

AI工程化
开源动态8

模型即智能体,Kimi K2 Thinking多项评估超越顶尖闭源模型,300轮工具调用不疲倦

月之暗面发布Kimi K2 Thinking,它是Kimi迄今最强开源思考模型,基于模型即智能体理念训练,可自主连续工具调用与多轮思考,多项评估超顶尖闭源模型,还实现原生INT4量化,提升生成速度。

AIGC开放社区
开源动态8

北大字节开源首个空推理视频模型!思考过程全透明,性能超越GPT-4o

北大和字节联合团队推出开源模型Open-o3 Video,将显式空证据嵌入视频推理全过程,采用non-agent架构,性能超越GPT - 4o等闭源模型。该模型构建了STGR语料体系,采用双阶段训练,实验表现优秀。

量子位
新闻资讯8

阿里云秘密武器亮相顶会:狂砍82%英伟达含量,213块GPU干了1192块的活

阿里云与北大合作,由CTO周靖人带队的研究提出GPU池化系统Aegaeon,亮相顶会SOSP。它用token级自动扩缩容技术,将GPU使用量从1192个减到213个,提升了资源利用率,还在百炼平台测试成功。

量子位
推荐文章8

配置驱动的动态Agent架构网络:实现高效编排、动态更新与智能治理

本文提出配置驱动的独立运行 Agent 架构,解决低代码/平台化 Agent 方案企业级落地难题。介绍其核心架构、注册中心、配置定义等,还提及 Agent Studio、执行引擎等,阐述运行部署、协作、治理,提供通用可落地范式。

阿里云开发者
产品应用8

字节跳动Seed推出「机器人大脑」Robix:让机器人学会思考、规划与灵活互动

近日,字节跳动Seed团队发布「机器人大脑」Robix,它将推理、任务规划与人机交互整合到单个端到端多模态模型。通过层次化架构分工,它能灵活互动,经三阶段训练,在多方面表现出色,为具身智能体发展奠基。

机器之心
算法论文8

多模态模型学会“按需搜索”,少搜30%还更准!字节&NTU新研究优化多模态模型搜索策略

字节与NTU优化多模态模型搜索策略,通过搭建工具、构建数据集及设奖励机制,用强化学习训练模型,使其按需搜索。实验显示,MMSearch - R1系统少搜30%还更准,为多模态大模型发展提供洞见。

量子位