停机问题」共找到 3190 篇相关文章

推荐文章8

【万字长文】大模型训练推理和性能优化算法总结和实践

本文总结大模型落地的训练、推理和性能优化算法与实践,介绍语言模型发展,对比BERT、GPT等训练方式,分析生成式大模型问题,还阐述数据处理、推理优化及训练调优等内容,并给出不同场景技术选型建议。

阿里云开发者
新闻资讯7

Google AI搜索革命的代价:网站流量暴跌一半,内容创作者哭了

皮尤研究中心报告显示,Google的AI概览功能使网站点击率狂跌近50%,其扩张速度惊人。用户看到AI概览后倾向直接结束搜索,内容创作者流量和收入锐减。Google回应称研究数据有问题,且AI还存在幻觉隐患。

AI工程化
开源动态8

让强化学习快如闪电:FlashRL一条命令实现极速Rollout,已全部开源

清华AIR、字节联合团队曾发布DAPO实现大规模LLM强化学习。刘力源、姚峰团队发现DAPO-32B中rollout生成是瓶颈,推出FlashRL,应用INT8/FP8,用TIS解决不匹配问题,加速显著且不牺牲性能,一条命令即可使用。

机器之心
新闻资讯7

ICCV 2025放榜!录取率24%,夏威夷门票你抢到了吗?

ICCV 2025 于 10 月 19 - 25 日在美国夏威夷举行,已公布论文接收结果,录用率 24%。投稿量近 2019 年三倍,录用率较稳定。会议实施新政策,部分论文因审稿人问题被拒引争议。还提及投稿量激增挑战及评审系统改革建议。

机器之心
开源动态7

AutoGLM深夜开源,千千万万个手机Agent要站起来了。

昨天深夜智谱将手机Agent AutoGLM开源,包含手机端智能助手框架和AutoGLM - Phone - 9B模型。它为解决隐私问题给出中间态解法,有3种部署模式,虽有不足,但让个人拥有本地手机Agent成为可能。

数字生命卡兹克
新闻资讯8

Ilya:扩展时代已经结束了,研究的时代已经开始

Ilya Sutskever 在播客访谈中深度探讨AI问题。他指出模型考试强但应用差,是因泛化能力不足;认为AI扩展时代结束,研究时代来临;还谈及AGI应是学习者,以及AI部署、安全对齐等观点。

宝玉AI
产品应用7

夸克“搜聊一体”新模式,难掩中国版ChatGPT的野心

夸克“C计划”首个落地项目对话助手引发热议。体验发现,它能完成复杂问答,还可用于图文识别、AI写作等场景。在回答逻辑性、辅助学习、理解模糊问题等方面表现出色,背后是阿里闭源模型。

鲸选AI
新闻资讯7

GPT-5波折超乎想象!奥特曼连夜回应一切:4o重新上阵,团队紧急补救

GPT-5发布后引争议,网友看法不一。奥特曼回应将全面更新,如翻倍ChatGPT Plus用户使用限额等。OpenAI团队在AMA问答中也解答诸多问题,包括让4o回归、研究多模型并用等。

新智元
产品应用8

拆解 Claude 5.1:38 小时不睡觉的背后,Anthropic 正在终结「模型论」

Anthropic 更新 Claude 5.1,推出 Fable 5.1 和 Mythos 5.1,将‘智力’与‘权限’物理剥离。前者负责通用任务,后者面向专业场景。此次更新展示模型解决长时任务状态一致性等问题的能力,还体现了能力权限分离等变化。

AI科技评论
算法论文7

实证:现在的LLM根本不会Reasoning!

论文指出当前大推理模型(LRM)如DeepSeek - R1等可能只是在表演“思考秀”,遇到复杂问题就崩溃。研究者用4个可控谜题测试,有三大颠覆发现,还揭示思考过程的荒诞现象,直指行业痛点并给出发展方向。

深度学习自然语言处理