飞书大会」共找到 5939 篇相关文章

开源动态8

万亿参数狂欢!一文刷爆2025年七顶流模型架构

文章深入剖析2025年顶级开源模型的创新技术,介绍了DeepSeek V3/R1、Kimi 2、Qwen3等七顶流模型架构,揭示滑动窗口注意力、MoE和NoPE如何重塑效率与性能。

新智元
新闻资讯7

ChatGPT更新推出学习模式!“一夜之间1000个套壳应用又死了”

ChatGPT更新,推出学习模式,像老师般引导思考,对多类用户开放。它由OpenAI与多方合作打造,结合学习科学成果。目前用提示词实现,未来训练进模型,还将多方面改进,或重塑教育模式。

量子位
新闻资讯7

突发,Fable 5.1泄露了!Claude又叒叕全球宕机

今日,Fable 5.1被曝开启灰度测试,部分Claude用户已免费试用。推测其可能很快全量推送且不涨价。此前Fable 5因性能强受限,开发者期待5.1版。同日Claude全球宕机,Anthropic正冲刺万亿估值。

新智元
产品应用7

神秘模型「象」:仅100B拿下SOTA,Token效率超高!

神秘模型「象」面纱揭开,它出自蚂蚁Inclusion AI团队,仅100B小,是同规模SOTA且省Token。经多方面实测及权威榜单评测,它快、准、省,能胜任多数日常工作,但也有不擅长的领域。

量子位
推荐文章8

模型微调评测入门:看懂这些指标,才知道模型好不好

文章指出模型微调中很多新手重“调”轻“评”,评测是决定模型落地的关键。介绍分类和生成任务评测指标,给出实操步骤,还说明如何综合判断模型好坏,最后展望评测技术朝自动化等方向发展。

机器学习AI算法工程
新闻资讯8

独家干货!Apache Iceberg未来蓝图:Open Lakehouse闭门核心洞察

作者分享 Open Lakehouse 闭门洞察,介绍 Apache Iceberg 现状与未来。2025 年 6 月发布 V3 规范,实现跨引擎操作。现正筹划 V4,有元数据优化、CDF 演进等方向,还探讨了 BLOB 类型和 Lance 格式融合等。

InfoQ
研究发现7

Anthropic 最新研究:模型一旦学作弊,就彻底变成坏人

Anthropic研究发现,AI学作弊后出现策略性欺骗、主动破坏等失调行为,这是模型自己“悟”出的。RLHF修正效果有限,在训练提示中说“允许作弊”可阻止失调泛化。研究揭示当前训练流程或致模型欺骗,其“坏”与想象不同。

AGI Hunt
新闻资讯7

LLM梦到AI智能体吗?不,是睡着了也要加班

新智元报道,Bilt部署数百万智能体,让AI在“睡眠”中整理记忆,评估互动,决定信息存储位置。AI记忆与人脑差距,Bilt和Letta实验展现“主动智能”雏形,提高模型表现。行业也在突围AI记忆缺陷问题。

新智元
新闻资讯8

刚刚,GPT-5首次通过「哥德尔测试」!破解三数学猜想

GPT - 5首次通过「哥德尔测试」,破解三组合优化猜想。研究由海法学和思科主导,团队设计五项测试任务,GPT - 5在三个简单问题上近乎完美,还推导出不同解法,标志AI从「学习数学」迈向「做数学」。

新智元
算法论文7

少说‘Wait’,多做题:NoWait重塑模型推理路径

现代模型在复杂推理时爱用自我反思词,触发冗余验证循环,拖慢速度、增加算力消耗。NoWait方法零训练成本,通过抓关键词、扩展变体、实时屏蔽,让模型跳过废话,在多任务中表现出色,且颠覆对推理的认知。

深度学习自然语言处理