新范式」共找到 4045 篇相关文章

新闻资讯7

跳出英伟达生态:OpenAI 发布编程模型 GPT-5.3-Codex-Spark,速度达 1000 token每秒

OpenAI 发布编程模型 GPT-5.3-Codex-Spark,跑在 Cerebras 晶圆级芯片上,速度达每秒超 1000 个 token,比传统 GPU 推理快约 15 倍,这是其跳出英伟达生态的里程碑。

AGI Hunt
产品应用8

捅破具身智能天花板!极佳视界VLA大模型登场,复杂长时程任务近100%成功率

极佳视界推出GigaBrain-0.5M*VLA大模型,以世界模型条件驱动,引入人在回路持续学习机制。在与主流方法对比中,任务成功率提升30%,长时程任务近100%成功,还具备高效准确的价值预测能力。

量子位
算法论文8

LLM内部竟藏着众多策略模型?自所&腾讯团队首次揭示大模型RL机制

中国科学院自动化研究所与腾讯AI Lab团队,从可解释性分析出发,发现LLM内部含多个可采样内部策略,揭示不同模型推理熵模式,提出BuPO算法,在复杂推理任务上表现优于传统算法。

PaperAgent
算法论文8

首次解释LLM如何推理反思!西北大学谷歌框架:引入贝叶斯自适应强化学习,数学推理全面提升

西北大学与Google、谷歌DeepMind团队质疑传统强化学习与反思的关系,提出贝叶斯自适应强化学习方法,首次解释为何、如何及何时反思探索策略,还给出决策数学形式,实验显示其性能更优。

量子位
新闻资讯7

李飞飞世界模型公司一年估值暴涨5倍!正洽谈一轮5亿美元融资

据彭博社消息,李飞飞创办的World Labs正以约50亿美元估值进行一轮最高5亿美元融资。此前已累计融资2.3亿美元。该公司研发“大世界模型”,推出3D世界生成模型Marble。此外,Yann LeCun创办的AMI Labs也获资本关注。

量子位
算法论文8

LLM内部竟藏着众多策略模型?自所&腾讯团队首次揭示大模型RL机制

中国科学院自动化研究所与腾讯AI Lab团队从可解释性分析出发,发现LLM内部含多个可采样内部策略,揭示不同模型推理熵模式,提出BuPO算法,在复杂推理任务上性能显著优于传统算法。

深度学习自然语言处理
产品应用7

Qwen深度研究一夜升级!可生成网页和音频播客,模型能认医生手写体

Qwen版深度研究加速进化,增加听觉和视觉输出,可生成网页和音频。改进功能同时更模型,Qwen3 VL能识别医生手写体。实测功能表现出色,Qwen3-VL系列更后性能优异。

量子位
产品应用8

美团龙猫LongCat技术升级!注意力机制解码速度快10倍,还能处理1M超长文本

美团龙猫LongCat系列发布全稀疏注意力机制LoZA,重点解决长文本任务难题。它在MLA机制基础改造,计算复杂度降至线性,处理128K上下文解码快10倍,性能不缩水,后续还计划支持动态稀疏比例。

量子位
产品应用7

无招回归后的钉钉 AI 重构:姿势尚显笨拙,但方向更对了

过去一年多科技行业进入AI泡沫阶段,多数产品只是+AI微创手术。钉钉发布8.0版本,推出钉钉One、AI搜问等产品。无招想从旧范式向AI原生范式迈进,虽部分产品尚显不足,但方向值得鼓励。

刘言飞语
新闻资讯7

Altman 秀模型“翻车”,谷歌补刀躺赢!OpenAI 前员工爆肝 3 天,编程再赢老东家模型!

近期,OpenAI 携多款未公开模型亮相。在 IMO 竞赛中,其宣称模型获金牌,谷歌 DeepMind 的 Gemini Deep Think 也达金牌水平,但网友对二者评价不一。此外,‘o3 Alpha’疑上线,前 OpenAI 员工还在编程赛中击败 OpenAI 模型。

InfoQ