训练阶段」共找到 2599 篇相关文章

新闻资讯8

Claude Opus 4.7发布!这是你在别的公众号看不到的五个发现

Anthropic发布Claude Opus 4.7,编码和视觉能力提升,但长上下文能力下降。其231页的System Card藏着不少有趣发现,如Opus 4.7非最强模型、Claude知道被测试、模型审查自身评估等。

花叔
开源动态7

GSD框架解析:解决AI编程工具Context Rot的工程化方案

文章介绍GSD框架,它旨在解决AI编程工具的Context Rot问题,通过Meta - prompting等方法将开发过程阶段化。提供常用命令稳定工作流,有实用新能力,适用于多种场景,以npm包部署,支持多平台。

小华同学ai
新闻资讯8

硅谷前沿访谈:CUDA之父复盘英伟达20年护城河,揭开万亿算力帝国的底牌

奇点智能研究院院长李建忠采访了“CUDA 之父”Ian Buck,探讨 CUDA 20 年演进、英伟达技术产品及生态。Ian Buck 介绍了 AI 基础设施新阶段,阐述 CUDA 成功原因,还谈及英伟达软硬件协同、应对竞争等问题。

AI科技大本营
新闻资讯7

刚刚,Anthropic首超OpenAI!暴买谷歌TPU,Claude杀疯了

Anthropic与谷歌、博通合作打造3.5 GW TPU集群,预计2027年上线。其年化收入破300亿美元首超OpenAI,客户呈指数级增长。但训练和推理成本高,与OpenAI都在冲刺IPO,竞争激烈。

新智元
新闻资讯7

堆推理链全错了!林俊旸离职首曝:曾在阿里 Qwen 踩中一个“致命”技术误区

阿里千问技术负责人林俊旸离职后发声,复盘 Qwen 训练尝试,指出合并 thinking 和 Instruct 模式不理想。他认为大模型未来应从‘推理思维’走向‘智能体思维’,并阐述了智能体思维的特点和挑战。

AI前线
新闻资讯8

紧急警告:LiteLLM PyPI 包被植入恶意代码,请停止更新

月下载量9700万的Python库LiteLLM被黑客植入恶意代码,36%云环境或受影响。恶意代码分三阶段,可窃取敏感信息。攻击源于供应链漏洞,黑客利用被盗凭证发布恶意版本。官方已采取措施,建议用户自查。

AGI Hunt
开源动态7

Karpathy刚刚敲响警钟:大模型的“终极之战”打响!Agent大军即将全面接管研发

Andrej Karpathy发布新项目autoresearch,人改提示词,AI改训练代码。经约2天微调,找到约20个降低验证损失的修改,提升排行榜成绩。Agent还发现多项重要改进点,未来前沿LLM实验室或走此路。

AI寒武纪
新闻资讯8

弯道超车?国产具身,千小时人类数据激发智能涌现

近日,深度机智用人类学习范式在国际 Benchmark 上击败巨头,成果两会首日被央视报道。其全新架构源于一年多积累。英伟达也有人类学习尝试。深度机智构建全栈技术矩阵,成果显著,3 月底成果将开源。

机器之心
算法论文8

32B逆袭GPT-5.2:首个端到端GPU编程智能体框架StitchCUDA问世

现有LLM自动化CUDA方法难处理端到端GPU程序,StitchCUDA提出多智能体框架+基于Rubric Reward的Agentic RL方案,分解任务、优化训练,在实验中成功率和加速比远超其他方法,解决Reward Hacking问题。

机器之心
开源动态7

OpenAI发布Symphony:AI时代的敏捷看板

OpenAI在GitHub发布Symphony项目,处于工程预览阶段。其核心理念是将项目工作转化为自主运行,通过看板管理工作流程。几乎同时,Paperclip项目宣布开源,提供完整企业架构。二者标志AI辅助开发向流程层面转变。

AI工程化