「贝叶斯优化技术」共找到 3776 篇相关文章
产业级 Agent 如何破局?百度吴健民:通用模型难“通吃”,垂直场景才是出路
InfoQ 采访百度吴健民探讨产业级 Agent 破局点。他指出 Agentic 模型训练卡点在真实环境复刻;通用模型难“通吃”,垂直场景定制模型是关键;多模态未实现统一建模,分开优化效果更好。
把RoPE扔掉,AI更能看懂长上下文!Transformer作者团队开源大模型预训练新方法
Transformer架构核心作者之一Llion Jones团队开源新技术DroPE,可丢弃位置嵌入扩展上下文,解决RoPE长序列处理缺陷,在多模型实验中表现卓越。该团队来自Sakana AI,此前还有相关研究成果。
打造Jarvis,OpenClaw很野,但Agent Studio简直变态
文章介绍OpenClaw和Agent Studio两个AI Agent项目。OpenClaw能打通AI Agent与多消息应用,适合技术团队搭建基础设施;Agent Studio可打造个人Agent工作台,重点展示其接入企微流程,还介绍四大核心功能。
Talking-Critic奖励模型带来更自然的音频驱动肖像
近期音频驱动肖像动画技术发展快,但现有方法存在嘴型声音不对、动作不自然等问题。阿里提出Talking - Critic奖励模型,构建Talking - NSQ数据集,还提出TLPO优化框架,提升多维度表现,实验超现有SOTA方法。
AI HR 挑选AI 简历,招聘市场正变成一场AI与AI的对决
LinkedIn求职申请过去一年激增45%,生成式AI是推手。求职者用ChatGPT优化简历、用AI代理申请,招聘方则用AI筛选和面试,还面临虚假身份问题。这引发对工作意义和真诚价值的思考。
本周六直播预约 | Test-Time Reasoning综述分享!
当大模型训练成本飙升、数据枯竭,推理阶段扩展Test-Time Scaling(TTS)成研究热点。论文提出四维正交分析框架,梳理主流技术路线,提炼发展路径,给出操作指南与未来思考,本周六将直播分享该综述。
DeepSeek开源MoE新利器LPLB:基于线性规划,专攻训练动态负载不平衡
DeepSeek在GitHub开源LPLB,这是基于线性规划的并行负载均衡器,用于优化MoE模型专家并行工作负载分配。它通过动态重排序、副本构建等机制实现动态负载均衡,支持多种拓扑结构,但也存在成本估算等局限性。
本周 5 个火火火的Github开源项目,每个都很有说法!
本周介绍5个Github开源项目。ai - berkshire将投资大师方法论系统化;stremio - web聚合视频资源;archify能将大白话描述变成架构图;Maple - font是优化的编程字体;Netcatty整合SSH客户端等功能。
软体机器人控制难题获解,比传统方法节能75倍,还能闭眼干活
美国两校研究人员结合生物学与人工智能工程学,用‘神经储备池’技术控制生物混合软手臂,实现稳定追踪、自我感知和低能耗运行,还在多方面展现优势,目前研究处于仿真阶段。
智谱AI今日正式上市,一文讲透你想知道的6件事。
今天智谱AI正式港股上市,股票代码HK2513。文章介绍其出身清华系,发布众多模型,融资顺利,虽亏损但研发投入大,商业模式围绕MaaS,未来押注技术、产品、人才,市场前景广阔。