在离线混部」共找到 8227 篇相关文章

产品应用7

编程进入「对讲机」时代!Claude抢发语音写代码,转录Token全免费

Anthropic给Claude Code加语音模式,输入 /voice,长按空格说话即可输入,转录Token全免。OpenAI的Codex也更新类似功能。语音编程Debug、架构讨论等场景好用,但识别变量名等仍有短板,未来编程将多模态。

新智元
开源动态8

ROLL:面向大规模语言模型的高效强化学习框架

本文介绍阿里推出的ROLL强化学习框架,专为LLM训练优化。它设计灵活,不同用户可用其满足业务、探索或线上指标需求。多任务训练中性能出色,还采用创新机制提升效率,支持自定义操作,适合学术和业务场景。

阿里云开发者
产品应用9

『书生·端砚』全面开放全栈服务,“算、证、验”三合一,筑牢科学智能底座 | 2026浦江创新论坛

上海人工智能实验室2026第十九届浦江创新论坛上,升级发布书生·端砚科学发现平台并全面开放全栈服务,升级三大核心能力,覆盖完整科研流程,已落地六大核心科研领域,开放给科研人员试用。

OpenMMLab
算法论文8

全球首个,连续时间具身世界模型!任意帧率自由生成

来自清华AIR与UC Berkeley BAIR的团队提出全球首个连续时间具身世界模型ODEWorld。它学习世界每个时刻的变化方向与速度,能任意帧率自由生成,统一了离散模型分散的生成能力。

新智元
开源动态8

35B参数科学性能比肩万亿参数模型,『书生』科学大模型Intern-S2-Preview开源

5月15日上海AI实验室开源新一代大模型预览版Intern - S2 - Preview,尺寸小、科学能力强,多方面有突破。其深化与昇腾算力生态协同,探索‘通专融合’,科学及智能体能力升级,还优化训推效率。

GiantPandaLLM
开源动态8

去掉 VAE 之后,商汤用 8B 参数重新定义了开源生图的上限

商汤SenseNova U1开源后引发开发者社区关注,它基于NEO - unify架构,摒弃VAE,实现多模态理解与生成原生统一。多项基准测试中表现出色,还针对企业办公场景优化,成为生产级任务新选择。

AI科技评论
开源动态8

无需多视角,单图重建可交互3D模型!南洋理工开源结构推理框架

南洋理工大学团队提出MonoArt,将单目可动物体重建建模为渐进式结构推理过程,通过四个关键模块逐步推理,无需外部先验,PartNet - Mobility基准测试中表现领先,兼顾推理效率,还可用于下游任务。

新智元
产品应用8

实测GPT-image-2,设计行业真的完蛋了吗?

GPT-image-2正式上线,实测效果震撼,文字渲染、世界知识、修改精准度和审美方面有显著进步。它让画图变得不再稀缺,冲击设计行业,但设计核心是思考,画图员时代结束,设计师时代刚开始。

数字生命卡兹克
新闻资讯7

The Batch: 938 | Gemini 的音乐生成器

Google将音乐生成器Lyria 3加入Gemini和YouTube,它接收文本或图像生成30秒音频,支持多语言歌词。质量和遵循提示上优于前身,采取版权保护措施,对特定用户免费或提供高额度使用。

DeeplearningAI
7

记录下SGLang开发,优化,debug的技巧之大SKILL时代已来临

文章记录SGLang开发等技巧,介绍Agent编程开发领域的强大能力,如完成多种工作、提升模型速度。还提及Agent流程优化方向,提醒警惕其偏差,指出人的价值转变,成为设计、把关和提炼者。

GiantPandaLLM