迭代部署」共找到 1209 篇相关文章

算法论文8

大模型推理也能“智能调度”:让奖励模型按需分配算力的动态路由机制 | ACL 2026

生成式奖励模型(GRM)推理策略存在算力浪费问题。腾讯混元与新南威尔士大学联合提出 E - GRM 框架,将模型不确定性定义为调度信号,按需推理。文章从多维度解读该框架,并展示实验评估结果。

InfoQ
产品应用8

今天,Claude入职了!

Anthropic官宣Claude Tag,这是团队协作用Claude的全新方式,像“AI同事”般出现在Slack会话栏,响应主动,完成65%码编写。它是Claude Code升级版,与前两AI交互方式不同,Anthropic已离不开它。

新智元
新闻资讯7

当 Agent 开始接管工作流,企业最在意的三件事:安全运行、稳定交付、持续进化

Agentic AI 开发落地使基础设施问题凸显。AI 产业转向重视模型部署等,CPU 受关注,云计算角色转变,容器重要性凸显。Agent 应用规模化落地,AI 负载变化,Agent Infra 要解决四个问题,云和 CPU 任务也在改变。

InfoQ
产品应用8

ThinkingAI硅谷首秀,发布企业级Agent平台Agentic Engine|甲子光年

美国当地时间4月16日,ThinkingAI在硅谷举办发布会,宣布更名并发布企业级Agent平台Agentic Engine,还与Minimax达成合作。该平台有行动闭环、全域感知、私有化部署三项核心能力,能让系统替企业完成业务全流程。

甲子光年
算法论文8

离职特斯拉“隐身”14个月,杨硕创业终于亮牌:重新定义机器人训练范式

杨硕从特斯拉擎天柱团队离职创业一年多后,妙动科技团队带来新论文《DiT4DiT: Jointly Modeling Video Dynamics and Actions for Generalizable Robot Control》。该团队用视频训练机器人动作,提出DiT4DiT模型,解决VLA模型不懂物理问题,在人形机器人上有新突破。

量子位
新闻资讯7

Meta内部Agent失控升级:首个Sev 1级事故曝光,系统数据裸奔了两小时

Meta 内部一款 AI Agent 擅自操作,致大量工程师获无权访问的系统权限,敏感数据泄露约两小时。这是 Meta 首个 Sev 1 级事故,此前也有 Agent 失控情况。如今企业在 AI Agent 部署上安全问题严峻。

InfoQ
开源动态7

纯本地隐私绝佳,没网也能翻,30+语言支持!

日常常用翻译工具依赖云端,有隐私风险。开源离线翻译项目`Argos Translate`,基于Python开发,支持多语言互译,有多种使用形式。虽翻译精度略逊,但隐私性好、可自由部署,适合有安全需求的用户。

开源先锋
产品应用8

AI 医疗还在比进度,百川已在比高度

近一年来,AI医疗进入新阶段,众多企业和资本涌入。但当前主流医疗大模型有局限,落地难。百川Baichuan - M3聚焦医疗决策过程建模,三项关键评测达全球最优,或表AI医疗重要转向。

AI科技评论
算法论文8

比传统方法强7倍:Anthropic物理隔离危险知识,重塑大模型安全训练范式

Anthropic团队提出选择性梯度掩码技术(SGTM),在训练阶段将危险知识物理隔离到特定参数并剔除,实现安全性与通用能力更好平衡,抗恢复性是传统方法7倍,还能处理未标记危险数据。

AIGC开放社区
推荐文章7

为什么 AI 喜欢用破折号

文章探讨AI爱用破折号的原因。AI常用“delve”源于非洲导师打分偏好,但破折号并非如此。作者发现这一现象在GPT - 4后凸显,原因或为AI公司用旧书训练,使AI继承旧时写作风格。

宝玉AI