存力需求」共找到 1325 篇相关文章

开源动态8

The Batch: 849 | 用于训练网页智能体的生成数据

开发网页智能体常需大量人标注训练样本,卡内基梅隆大学与亚马逊团队实现训练数据生成自动化。他们构建数据集,通过智能体工作流程生成数据,微调后 Qwen3 - 1.7B 表现出色,还公开数据与方法。

DeeplearningAI
产品应用8

扩散语言模型写代码!速度比自回归快10倍

Inception Labs推出基于扩散技术的大语言模型Mercury,它突破自回归模型限制,生成速度快,还解决了难以回头调整的问题。实测显示其代码生成速度比传统工具最多快10倍,且有强大纠错能,但面临与当前CI能不匹配问题。

量子位
产品应用8

腾讯发布Hunyuan-GameCraft!从静图进入动态游戏世界

近年来,现有方法难满足游戏视频生成需求。腾讯推出Hunyuan - GameCraft,可基于一张图像和提示词生成游戏交互视频,能精准响应交互信号,保留历史场景信息,不过动作空间待丰富。

带你学AI
新闻资讯7

AMD发布旗舰AI芯片,称性能比肩英伟达

当地时间6月12日,AMD CEO苏姿丰在大会展示多款AI新品,将新AI芯片与英伟达同类产品对比,称性能比肩且性价比高。还展示了新软件栈、介绍下一代AI机架产品,预计推理成未来AI发展主驱动

芯师爷
算法论文8

想知道你的LLM API被过度收费了吗?隐藏的Tokens终于可以被审计了

马里兰大学CASE Lab团队研究商业不透明大模型服务(COLS),定义其风险,提出三层审计蓝图。还推出验证框架CoIn,能高效识别token数量膨胀,有可定制性且审计开销低,为构建信任提供技术支撑。

机器之心
产品应用7

一个国产AI视频产品如何吸引全球6000万用户?|甲子光年

文章围绕爱诗科技旗下AI视频产品PixVerse展开,讲述其吸引全球6000万用户的历程。介绍创始人王长虎两次技术路线转型,先做To C再推API,还谈及B端业务场景及‘拍我AI’国内上线等情况。

甲子光年
开源动态8

上海AI实验室造出首个「通才」机器人大脑:看懂世界+空间推理+精准操控全拿下

上海人工智能实验室联合多家单位提出通用具身智能大脑框架VeBrain,能集成视觉感知、空间推理和机器人控制能。它统一三类任务语言建模范式,有“机器人适配器”,配套VeBrain - 600k数据集,性能测试表现出色。

量子位
新闻资讯7

Chimer AI 黄祯:自然而然地干了离经叛道的事 | 00 后创业者系列

本文是对 00 后创业者黄祯的访谈。他大学休学创业,先尝试珠宝等行业,后聚焦服装产业。起初做 SaaS 工具,因国内市场不佳转向 Agent 与 SaaS 结合,还获吴世春融资,分享了创业经历、思路及产品特点。

AI科技评论
算法论文8

腾讯混元 TurboS 技术报告首次全公开:560B 参数混合 Mamba 架构,自适应长短链融合

日前腾讯混元 TurboS 技术报告全公开。它是超大型 Hybrid Transformer - Mamba 架构 MoE 模型,有自适应长短思维链机制,总参 560B。在多榜单成绩亮眼,多语种和多任务处理能强,还介绍了核心创新、训练策略等。

InfoQ
开源动态7

ICML25 | 让耳朵「看见」方向!仅依靠360°全景视频,就能生成3D空间音频

空间音频技术成提升沉浸式体验关键,但现有技术未充分利用360°全景视频空间信息。OmniAudio研究可直接从360°视频生成空间音频,相关代码和数据集已开源,虽有局限但前景好。

量子位