「DeepSeek-V4.1」共找到 3291 篇相关文章
Claude Code 推出 /loop 无限循环,一台电脑即可化身无数小龙虾
Claude Code发布v2.1.71,推出`/loop`功能,可让Claude在后台循环执行任务。它能将Claude Code从问答工具变为自主运转的Agent,配合CLAUDE.md和Git hook可构建自主Agent系统,还能同时跑多个实例。
Greg Brockman(OpenAI 联合创始人)把“那场宫斗”讲完整了:董事会、请愿书、马斯克与控制权
OpenAI联合创始人Greg Brockman做客播客,讲述公司“宫斗”内幕、与马斯克谈判细节等。还谈及模型能力、算力瓶颈、AI应用等,如GPT 5.1到5.2有质的飞跃,算力将成基本人权,AI推翻物理假设。
40倍推理加速!复旦&微软:用「非线性流」拟合复杂轨迹,2步生成媲美原画
ArcFlow是复旦与微软提出的图像生成加速方案,引入非线性流拟合复杂轨迹。它在仅2步推理下保持画质,实现约40倍推理加速和4倍训练收敛加速,微调极少参数,在多模型验证效果出色。
字节悄咪咪上线了 AI 版抖音「随变」,在下什么棋?
临近春节,字节跳动 1 月初上线的「随变」App 在年轻人中流行。它类似「纯净版」AI 抖音,核心功能有 AI 形象生成等。字节借此在小体量社区验证功能,解决抖音年轻用户留存问题,也想抢占 AI 视频市场。
当前关于 Vibe Engineering 的所有认知都会在 1 个月内严重过时
作者分享 Vibe Engineering 实践体会,指出当前认知很快过时,因 AI 编程工具和模型进步大。还对比了 Opus 4.5、GPT - 5.2 等模型,阐述人在开发各阶段角色,介绍多 Agent 协同实践及未来软件公司组织形态变化。
我所知道的闫俊杰
文章讲述了MiniMax掌门人闫俊杰的故事。他技术功底深厚,在商汤时提出创新算法成名。创业后,他以AGI为目标搭建人才体系,推出Glow等产品。虽面临DeepSeek竞争等困境,但坚持模型与产品一体化发展。
首个AI同事正式「入编」!CES 2026超级组织引爆
2026 CES大会上AI成核心主题,出门问问带来TicNote家族‘全家桶’。TicNote Cloud以项目为核心,让AI成团队协作者,其搭载的Shadow AI 2.0能力升级,配合硬件构建端到端工作流,开启协作4.0时代。
OpenAI突然开源新模型!99.9%的权重是0,新稀疏性方法代替MoE
OpenAI悄悄开源新模型,0.4B参数且99.9%权重为零,是Circuit Sparsity技术的开源实现。该技术通过约束模型内部连接稀疏性,解决传统稠密Transformer黑箱问题,或让MoE模型走上末路,但目前算力成本极高。
华为刚投的物理AI:首家国产世界模型公司
华为哈勃联合华控基金对极佳视界进行亿元级A1轮投资。该公司是国内首家“纯血”物理AI公司,产品覆盖全栈软硬件,应用于自动驾驶和具身智能。华为偏好世界模型技术,此次投资信号明显。
2张4090竟能本地微调万亿参数Kimi K2!趋境联合清华北航把算力门槛击穿了
仅需2 - 4张消费级显卡(4090),就能在本地对DeepSeek 671B乃至Kimi K2 1TB这样的超大模型进行微调。这得益于KTransformers和LLaMA - Factory两个国产明星项目联动,大幅降低成本,开启AI个性化定制时代。