GPT - 5.6 Sol」共找到 2734 篇相关文章

算法论文7

最新发现!每参数3.6比特,语言模型最多能记住这么多

Meta、DeepMind等团队研究语言模型记忆容量,提出新方法估计模型对数据点的‘了解’程度,发现GPT系列模型约每个参数3.6比特,还提出模型容量等相关定律,激发社区多方面思考。

机器之心
新闻资讯8

刚刚,清华黄高、北大刘譞哲等入选2026科学探索奖

2026年「科学探索奖」获奖名单揭晓,50位青年科学家入选,覆盖10个领域。其中信息电子领域5人,包括清华黄高、北大刘譞哲等,他们研究方向多元,成果显著,对AI发展意义重大。

机器之心
算法论文8

DeepSeek-V4蓄势待发!梁文锋署名论文或开启第二个DeepSeek时刻

据报道,DeepSeek将于2月发布新一代旗舰模型DeepSeek V4,其编程能力或超Claude和GPT系列。最新论文提出Engram条件记忆机制,分离死记硬背与逻辑推理,揭示新稀疏性分配定律。

AIGC开放社区
新闻资讯8

Nature发布Delphi-2M模型,提前20年预测你得什么病

2025年9月17日《自然》发表研究成果,欧洲、德国和丹麦科学家改造GPT架构,推出Delphi - 2M模型。它能预测1258种疾病及死亡风险,依据过往病史等提供风险概率,虽有局限但潜力大。

AIGC开放社区
新闻资讯7

Cursor 慌了:当 AI 不再需要代码编辑器

Anthropic新模型Opus 4.5编程能力强大,开发者无需逐行审查代码,可直接向智能体下达指令获取成品,这冲击了Cursor代码编辑器业务。虽Cursor收入增长,但面临焦虑,正努力自研模型、拓展企业客户。

宝玉AI
新闻资讯7

算力越高收入越多!OpenAI率先验证AI商业Scaling Law:最新收入200亿美元

OpenAI首席财务官公告显示,其年化经常性收入从20亿美元涨至200亿美元,2023 - 2025年算力增9.5倍、收入增10倍。挣得多也烧得多,其还投建数据中心。首款硬件或2026下半年推出。

量子位
开源动态8

刚刚国产双响炮炸场!智谱「牛来模型」和阿里Qwen3.8-Flash双双亮相屠榜

智谱发布GLM - 5.3 - Flash(牛来模型),原生多模态,支持1M token上下文,运行在国产芯片,价格实惠。阿里开源Qwen3.8 - Flash - Next权重,成本低性能优,在四大维度重构架构。

AI寒武纪
算法论文8

不换模型,效果提升104%!上海AI Lab让Harness也能自进化了

上海人工智能实验室团队提出的Self-Harness引发关注,它针对Agent外层Harness改进。实验显示,在Terminal-Bench-2.0上,不换模型只改Harness,Qwen3.5-35B-A3B等模型效果显著提升。

量子位
新闻资讯7

Karpathy刚进Anthropic,转头又投了它

AI初创公司Engram成立8个月,估值达6亿美金,获9800万美元融资。它聚焦AI记忆,用Cartridges技术降内存、提速度,将推理和记忆层拆开,团队成员背景强大,押注AI范式新转向。

新智元
新闻资讯7

彭博社突发:OpenAI 的中国最强对手,将开源最新 SOTA 模型

据彭博社报道,中国AI独角兽智谱AI(Z.ai)周一将发布最大开源模型GLM - 4.5,这是旗舰模型重大更新版。此前OpenAI警告智谱扩张迅速。近期中国AI初创公司开源竞赛激烈。

AGI Hunt