高性能渲染」共找到 3513 篇相关文章

产品应用8

起底“豆包手机”:核心技术探索早已开源,GUI Agent布局近两年,“全球首款真正的AI手机”

当红的“豆包手机”技术详情被证实,其助手技术基于字节自研的UI-TARS模型,该模型初代开源后引发热议,“豆包手机”用的闭源版性能更优。UI-TARS历经迭代,成果成热门开源多模态智能体。

量子位
产品应用8

估值 7 亿美元的 AI 语音输入产品:语音输入的关键问题是听写,不是转录

AI语音输入产品Wispr Flow发展迅猛,ARR 5个月翻10倍,公司估值超7亿美元。其创始人Tanay Kothari认为,该产品与其他同类最大区别是理解用户意图,解决听写而非转录问题,还分享了产品特点等内容。

Founder Park
7

Jina AI创业复盘:AI团队的Scaling Law是什么

本文是对 Jina AI 创始人肖涵的访谈,复盘六年创业历程。他两次转型,最终聚焦搜索底座模型,公司被 Elastic 收购。他分享创业得失,认为团队聚焦、效运营是壁垒,还给出未来创业者专注、找优秀人才等建议。

Jina AI
算法论文8

PixelRefer :让AI从“看大图”走向“看懂每个对象”

多模态大模型多停留在整体场景级理解,现实任务需细粒度、对象级理解。浙江大学等联合提出PixelRefer框架,可实现精细视觉指代与推理,在多项任务表现领先,轻量版性能优,还开源两类数据集。

机器之心
新闻资讯8

MiniMax M2 发布即爆,拿下开源模型第一名

10月27日,MiniMax发布新一代文本大模型M2及由其驱动的MiniMax Agent。M2是专家混合模型,参数达230B但激活仅10B。它在开源模型评测中夺冠,能低成本、速度支撑工作流,开发者评价

MacTalk
新闻资讯7

Sora天才辍学生归来!OpenAI组建3人神秘小队,豪赌超级人工智能

当年Sora背后的核心贡献者、00后天才辍学生Will Depue,结束休息重回OpenAI,拉上Troy Luhman和Eric Luhman组成三人小组,目标是超级人工智能ASI。OpenAI也将目标从AGI转向ASI,不过追求ASI风险、投入大。

新智元
产品应用8

将科研脏活累活真·丢给AI!上海AI Lab推出深度科研智能体FlowSearch

上海人工智能实验室推出深度科研智能体FlowSearch,它由动态结构化知识流驱动,有三大核心模块。在多个科研基准上性能领先,能让科研更效,标志科研智能体迈向新阶段,还为未来系统奠定基础。

量子位
算法论文8

清华大学x生数科技:从波形到隐空间,AudioLBM引领音频超分新范式

音频超分辨率是提升音频体验的关键技术,但频细节损失是挑战。OpenAI的Sora 2树立保真音频生成标杆,现有学术模型有局限。清华与生数科技团队发表两项成果,AudioLBM展现通用分辨率音频生成潜力。

量子位
算法论文8

算力成本大降!马尔可夫思考机来了,LLM推理成本直接降为线性

用强化学习让LLM具备推理能力耗费颇,计算量会二次级增长。Mila和微软研究院等团队提出马尔可夫式思考机,重构强化学习形式,让计算量呈线性,实验效果显著,还能与先进模型兼容。

机器之心
新闻资讯8

大模型七连发,外国人馋透了!阿里云栖大会全栈升级够狠

阿里在2025云栖大会全栈升级,发布七款通义新模型,从基础大模型到各专项领域全覆盖。旗舰模型Qwen3 - Max性能超GPT - 5等,新架构Qwen3 - Next实现效率突破,多模型开源且表现出色。

机器之心