「GPT - 5」共找到 2297 篇相关文章
腾讯AI Lab 提出解耦推理新框架,破解IMO 数学难题
腾讯AI Lab梁振文和宋林峰提出“解耦推理与证明”框架,解决当前大语言模型在自动化定理证明领域“思考”与“证明”能力失衡问题,成功解决5道IMO难题并开源成果。
最新发现!每参数3.6比特,语言模型最多能记住这么多
Meta、DeepMind等团队研究语言模型记忆容量,提出新方法估计模型对数据点的‘了解’程度,发现GPT系列模型约每个参数3.6比特,还提出模型容量等相关定律,激发社区多方面思考。
刚刚,清华黄高、北大刘譞哲等入选2026科学探索奖
2026年「科学探索奖」获奖名单揭晓,50位青年科学家入选,覆盖10个领域。其中信息电子领域5人,包括清华黄高、北大刘譞哲等,他们研究方向多元,成果显著,对AI发展意义重大。
DeepSeek-V4蓄势待发!梁文锋署名论文或开启第二个DeepSeek时刻
据报道,DeepSeek将于2月发布新一代旗舰模型DeepSeek V4,其编程能力或超Claude和GPT系列。最新论文提出Engram条件记忆机制,分离死记硬背与逻辑推理,揭示新稀疏性分配定律。
Nature发布Delphi-2M模型,提前20年预测你得什么病
2025年9月17日《自然》发表研究成果,欧洲、德国和丹麦科学家改造GPT架构,推出Delphi - 2M模型。它能预测1258种疾病及死亡风险,依据过往病史等提供风险概率,虽有局限但潜力大。
阿里电影级视频模型万相2.6系列上线,功能比Sora2还全,人人都能当导演
12月16日,阿里发布通义万相2.6系列模型,5款新模型同时上线,覆盖图像到视频多环节。它是国内首个支持角色扮演的视频模型,功能比Sora2全,已上线阿里云百炼和万相官网。
Cursor 慌了:当 AI 不再需要代码编辑器
Anthropic新模型Opus 4.5编程能力强大,开发者无需逐行审查代码,可直接向智能体下达指令获取成品,这冲击了Cursor代码编辑器业务。虽Cursor收入增长,但面临焦虑,正努力自研模型、拓展企业客户。
算力越高收入越多!OpenAI率先验证AI商业Scaling Law:最新收入200亿美元
OpenAI首席财务官公告显示,其年化经常性收入从20亿美元涨至200亿美元,2023 - 2025年算力增9.5倍、收入增10倍。挣得多也烧得多,其还投建数据中心。首款硬件或2026下半年推出。
刚刚国产双响炮炸场!智谱「牛来模型」和阿里Qwen3.8-Flash双双亮相屠榜
智谱发布GLM - 5.3 - Flash(牛来模型),原生多模态,支持1M token上下文,运行在国产芯片,价格实惠。阿里开源Qwen3.8 - Flash - Next权重,成本低性能优,在四大维度重构架构。
不换模型,效果提升104%!上海AI Lab让Harness也能自进化了
上海人工智能实验室团队提出的Self-Harness引发关注,它针对Agent外层Harness改进。实验显示,在Terminal-Bench-2.0上,不换模型只改Harness,Qwen3.5-35B-A3B等模型效果显著提升。