「高精度模型」共找到 8869 篇相关文章
稳定训练、数据高效,清华大学提出「流策略」强化学习新方法SAC Flow
本文介绍清华大学和CMU提出的SAC Flow新方案,可端到端优化流策略。它将流策略视作residual RNN,用GRU和Transformer结构稳定训练。在多环境测试中表现优,有稳定、快速、样本效率高的特点。
LangChain 不看好 OpenAI AgentKit:世界不需要再来一个 Workflow 构建器
OpenAI发布工具集AgentKit,含可视化画布Agent Builder。LangChain创始人Harrison Chase锐评,市场不需要这种可视化工作流构建器,因其不是真正的Agent构建器,且面临高低复杂度问题挤压。
谢赛宁新作:VAE退役,RAE当立
谢赛宁团队研究表明VAE时代结束,RAE将接力。RAE是用于扩散Transformer训练的新型自动编码器,能提供高质量重建结果,有语义丰富潜空间,支持可扩展架构,收敛快,在ImageNet图像生成效果强劲。
AI「学不会」竟成相变探针!UCSD华人联手谷歌等,曝光量子纠缠秘密
加州大学圣地亚哥分校华人学者Wanda Hou等与Google Quantum AI合作,在谷歌超导量子处理器实验,发现机器学习模型‘学不会’对应量子体系测量诱发相变,AI失效成物理探针,还展望了量子AI前景。
如何改变AI研究范式?谷歌DeepResearch新方法TTD-DR原理与实现 | 原理篇
谷歌提出新的DeepResearch方法TTD - DR,它模拟人类研究范式,将Agent起草的初稿视为‘含噪声输出’,经多轮检索 - 改进使初稿成高质量终稿,还引入自进化机制,测试显示其在复杂任务上领先。
OpenAI两位首席最新采访信息量好大!终极目标是“自动化研究员”,招人并非寻找“最出圈”的人
OpenAI首席科学家Jakub Pachocki和首席研究官Mark Chen在采访中爆料,谈到GPT - 5将推理引入主流、实现自动化研究员目标、强化学习未到瓶颈等,还阐述用人标准、算力分配等问题。
就在刚刚,ChatGPT发布了一个新功能Pulse
北京时间凌晨,山姆·奥特曼宣布 OpenAI 为 Pro 用户上线 ChatGPT Pulse 预览版,后续会扩展到 Plus 用户及所有人。Pulse 核心是主动推送个性化更新,能结合多信息生成内容,但需用户开放大量个人数据,隐私问题值得关注。
上任两年,吴泳铭为阿里 AI 定调:终局是 ASI
吴泳铭出任阿里 CEO 两年,在云栖大会提出 AI 终局是 ASI。阿里云升级全栈 AI 体系,通义大模型 7 连发,百炼平台更新。吴泳铭判断通往 ASI 分三阶段,阿里为此推进 3800 亿建设计划。
“扁平+拓扑”双索引,85页PDF"秒级"推理,MMRag幻觉率骤降76%
多模态长文档视觉问答常见于科研论文等场景,现有技术路线有大视觉 - 语言模型直接端到端和检索增强生成,但各有缺点。MMRAG - DocQA引入新方案,解决多模态连接和跨页证据链接问题。
做路由器Wi-Fi芯片为什么那么难?
TP - Link芯片部门全员解散引发关注。做路由器Wi - Fi芯片技术难,要同时研发CPU主控和Wi - Fi芯片,且比端侧Wi - Fi芯片要求高。市场方面,不同地区市场各有挑战,创业需谨慎。