4K直出」共找到 2108 篇相关文章

新闻资讯7

用户痛批GPT-5,哭诉「还我GPT-4o」,奥特曼妥协了

OpenAI发布GPT - 5,移除ChatGPT模型选择器,将其设为默认模型并自动分配子版本。这引发用户不满,有人做梗图、吐槽、发起签名信。奥特曼发话,允许ChatGPT Plus用户继续用GPT - 4o。

机器之心
开源动态8

华为新开源!扩散语言模型突破32K上下文,还解锁了「慢思考」

今年文本生成领域从自回归向扩散语言模型转变,但长序列训练不稳定是痛点。华为发布 openPangu-R-7B-Diffusion,将上下文长度扩至 32K,在多基准创 7B 参数量级 SOTA,还解析了其技术革新。

机器之心
算法论文7

Transformer死角,只需500步后训练,循环模型突破256k长度泛化极限

线性循环模型能处理极长序列,是相比Transformer的关键优势,但过去循环模型性能不足且难以泛化。CMU等研究者证明,通过简单训练干预,循环模型500步后训练可突破256k长度泛化极限。

机器之心
算法论文8

MIT发布自适应语言模型!新任务,自生成远超「GPT-4.1合成训练数据」

麻省理工学院提出自适应语言模型框架SEAL,让大模型生成微调数据和更新指令适应新任务。实验显示,其生成的合成数据微调效果超GPT - 4.1,在少样本学习和知识整合任务表现优异。

新智元
产品应用8

Claude Sonnet 4.5发布,多领域性能超越GPT-5和Gemini 2.5 Pro

Anthropic发布Claude Sonnet 4.5,是目前最强编程模型,在多领域性能超GPT - 5和Gemini 2.5 Pro。操作电脑、数学推理能力提升,产品更新功能丰富,安全性增强,价格不变,获多家公司认可。

AI工程化
产品应用8

超棒Claude官方提示词:Anthropic发布Claude 4.x提示工程最佳实践

Anthropic发布Claude 4.x提示工程最佳实践,这些原则在顶尖大模型中一般通用。它强调精准指令驱动性能,构建记忆与状态管理机制,优化工具调用编排,激发高阶认知与专业输出,重塑代码美学与工程规范。

AIGC开放社区
开源动态8

升级版Qwen3开源模型深夜来袭,超越Kimi-K2、DeepSeek-V3

深夜阿里千问推出 Qwen3-235B-A22B-Instruct-2507-FP8 版本。新模型通用能力显著提升,在多测评中表现出色,超 Kimi-K2 等模型。还增强多语言知识覆盖等性能,已在魔搭和 HuggingFace 开源。

机器之心
新闻资讯8

OpenAI 发布GDPval,可真实评估现实世界经济价值。Claude Opus 4.1 拿下第一

OpenAI推出GDPval,可评估AI在真实经济价值任务上的表现。它从9个行业选44种职业,设1320个真实任务。Claude Opus 4.1表现最佳,前沿模型速度快、成本低。OpenAI计划扩展GDPval,还开源部分内容。

AGI Hunt
产品应用8

我们用飞书开了个选题会,一下进入现代化办公,编辑部呼:真香

2025年飞书未来无限大会上,飞书发布和升级诸多产品。如达M3标准的知识问答,可秒搜文档;达M4标准的飞书会议,支持声纹识别。多维表格性能提升、应用构建升级,还有AI工具全家桶。

机器之心
新闻资讯7

RLHF已死,RLVR引爆AGI革命!Claude 4核心成员万字对谈

Claude 4核心成员对谈指出,强化学习在语言模型上奏效,可验证奖励的强化学习(RLVR)比RLHF更优,模型有望从「专才」向「通才」过渡,未来AI智能体将完成白领工作,人们应做好准备。

新智元