字节豆包1.6」共找到 2498 篇相关文章

开源动态7

类R1训练不再只看结果对错!港中文推出SophiaVL-R1模型

DeepSeek - R1爆火后,类R1结果奖励训练范式引发推理热潮,但仅以结果对错奖励模型有弊端。港中文联合团队发布多模态推理模型SophiaVL - R1,引入‘思考奖励’机制,还用Trust - GRPO算法解决奖励欺骗问题。

机器之心
开源动态8

腾讯混元世界模型1.1开源:单卡秒级重建3D世界成为现实

腾讯混元团队开源混元世界模型1.1,它是混元3D世界模型1.0升级版。新增多视图及视频输入,单卡可部署,秒级创造3D世界。有核心突破,能处理多任务,经训练策略优化,多测试表现佳。

AIGC开放社区
产品应用8

Claude 5.1双旗舰突然发布:跑分屠榜,反蒸馏,科研能力大幅跃升,缓存费用暴降75%

Anthropic发布Claude Fable 5.1和Claude Mythos 5.1两款大模型,性能登顶且解决开发者关注问题。缓存读取费用降75%,跑分屠榜,科研能力强,安全系统重构,合作实测效果好,盲测风格与GPT - 5.6 Sol不同。

AI寒武纪
产品应用8

起底“豆包手机”:核心技术探索早已开源,GUI Agent布局近两年,“全球首款真正的AI手机”

当红的“豆包手机”技术详情被证实,其助手技术基于字节自研的UI-TARS模型,该模型初代开源后引发热议,“豆包手机”用的闭源版性能更优。UI-TARS历经迭代,成果成热门开源多模态智能体。

量子位
开源动态7

Uno Platform 6.6 发布:Android 启动性能最高提升 61%

Uno Platform 6.6发布,在五平台引入原生AOT发布、可选Vulkan渲染后端等。聚焦运行时性能,提升多平台启动速度,还简化XAML编写,增强AI辅助、无障碍及多语言支持等。

InfoQ
算法论文7

Megatron 1F1B流水线并行中的负载不均衡问题研究

文章分析Megatron 1F1B流水线并行中负载不均衡问题。通过实验发现通信时间‘一短一长’,原因是最后一个Stage计算慢致不同步,额外计算引发通信延迟,还梳理了流水线各阶段执行过程。

GiantPandaLLM
新闻资讯7

Replit ARR 突破 1 亿美金,1000 万到 1 亿只用了6 个月

Replit 从在线编程工具起步,借助 AI 能力实现增长。近期宣布 ARR 突破 1 亿美金,从 1000 万到 1 亿仅用 6 个月。它起源于降低编程门槛的愿景,早期营收不佳,2024 年转型后靠 Agent 产品爆发。

投资实习所
产品应用8

文心X1.1发布!这三大能力突出,一手实测在此

百度深度思考模型文心X1.1升级上线,在事实性、指令遵循、智能体等能力显著提升,实测表现佳。WAVE SUMMIT 2025大会还发布开源模型ERNIE - 4.5 - 21B - A3B - Thinking等,飞桨框架也升级到v3.2。

量子位
开源动态7

智谱开源GLM-4.5工具调用超越Claude Opus 4.1,成本仅1.4%

开源模型GLM-4.5在伯克利工具使用榜单上超越Claude Opus 4.1,运行相同任务成本仅为1.4%。它采用MoE架构,在多场景表现卓越,推理速度快,成本低,还接入多款主流编程工具。

量子位
开源动态8

最强大脑组合!全球SOTA的逻辑和记忆CodeBrain-1&MemBrain1.5同时开源

世界模型初创公司Feeling AI正式发布并开源MemBrain1.5和CodeBrain-1,终结AI“无状态”工具时代。CodeBrain提升模型操作成功率、降低成本,MemBrain重构记忆系统,二者助力Agent能力升级。

机器之心