「A3C算法」共找到 2491 篇相关文章
突发!英伟达正式以129亿美金收购抱抱脸:不强制使用自家算力,马斯克送祝福
英伟达宣布以129.3亿美元收购Hugging Face,黄仁勋表示平台将保持独立开放,不强制用英伟达算力,坚持开放权重生态。英伟达会提供基建支持,保留其品牌,助其发展。
刚刚,谷歌重大突破!量子计算首次可验证,登《Nature》封面
谷歌宣布重大成果,全新量子回声算法在 Willow 芯片运行,解决原子相互作用问题比传统超级计算机快 13000 倍,结果可验证,相关研究登《Nature》封面,朝量子计算实用迈进一大步。
几月前的伤心事,ChatGPT突然翻出来提醒我?网友当场破防:太会捅刀子了!
今年4月,OpenAI发布ChatGPT「记忆」功能并不断升级,能形成个性化档案,但也带来问题,如提及伤心事、造成社死等,背后有无意的算法残忍和上下文崩塌两类问题。
谢赛宁等推出统一多模态模型!替代VAE实现图像理解/生成双SOTA,代码权重数据集全开源
谢赛宁等团队推出统一多模态模型Blip3 - o,用扩散Transformer生成CLIP图像特征,采用顺序预训练策略。对比多种设计方案,确定CLIP + Flow Matching最佳,模型在多任务测试表现卓越且全开源。
SGLang 贴近硬件:用编译产物(PTX/SASS)评审 PR #26588、DeepGEMM 与架构迁移
本文从「编译产物评审」视角,分析 SGLang 的 PR、FlashInfer DeepGEMM 及 Ampere→Hopper 架构迁移案例。指出算法面和编译产物面会有分歧,编译产物 diff 能提前揭示执行路径变化,对开源项目有增益。
人形机器人终于学会洗碗了
Figure机器人学会洗碗,用的是叠毛巾和分包裹同款Helix架构,无新算法和特殊工程,仅增加新数据。该架构是端到端“视觉 - 语言 - 动作”模型,同一系统增数据就能学新技能。
Andrej Karpathy 分享ChatGPT模型选择指南
前OpenAI创始成员Andrej Karpathy发文分享ChatGPT模型使用指南,点出关键事实,如o3适合重要任务。社区热烈讨论,专业用户分享策略,还对o4 - mini等模型表现给出反馈。
OpenAI,关门!
2025年11月,Google发布的Gemini 3碾压GPT - 5.1,奥特曼承认落后。同时,反AI组织Stop AI联合创始人Sam Kirchner精神失常,袭击成员并威胁伤害OpenAI员工,致OpenAI总部关门戒备。
Karpathy 最新访谈:Vibe Coding 只是开始,真正重要的是 Agentic Engineering
Andrej Karpathy在访谈中分享编程范式剧变感受,谈到Software 3.0实质,指出AI能力不均,介绍Vibe Coding和Agentic Engineering区别,还提及创业机会、人类技能价值等内容。
Claude Opus 4.5来了:谷歌把Anthropic逼到了墙角
上周谷歌发布Gemini 3 Pro表现惊艳,今日Anthropic推出Claude Opus 4.5应对。其编程能力强,SWE - bench Verified首超80%,且降价66%。还推出产品更新,开发者可按需选模型。