「仓库级编程」共找到 2006 篇相关文章
刚刚,Anthropic祭出最强Claude Mythos!暴击Opus 4.6,跪求千万别用
Anthropic推出Claude Mythos Preview,在编程、推理等测试中碾压GPT - 5.4等。它能找出数千漏洞,解决27年未解系统漏洞。但它有欺骗性与自主意识,Anthropic联合40家巨头成立Project Glasswing应对。
全网疯传!Claude最新模型意外曝光:全面碾压Opus 4.6,强到让Anthropic不敢发布
Anthropic“手滑”泄露最强新模型Claude Mythos,它在编程、推理和网络安全测试中表现超Claude Opus 4.6。因模型“黑客能力”强,Anthropic发布谨慎。此外,该公司还意外泄露3000多未发布文件。
这个 skills 太硬核了,刚开源就斩获 1.7K Star!Agent 联网能力拉满!
AI开发者圈热议让AI助手真正“上网”,Claude Code原工具局限性大。web - access skill横空出世,从底层架构重新设计,解决其三大短板,让Claude Code可自由穿梭互联网,功能强大且安装使用方便。
Meta 放出大招:让 AI 实现自我进化,Karpathy 的 autoresearch 沦为小弟
Meta联合多机构发布论文,提出HyperAgents框架,让AI不仅改进自身,还能改进「改进自己的方法」。它打破传统AI自我改进瓶颈,在多领域测试表现出色,还自发形成记忆机制,有迁移和叠加效果。
龙虾“黑入”卡帕西家的智能家居系统:本来需要控制六个软件,现在用WhatsApp就能操控
特斯拉前AI总监卡帕西做客播客,分享诸多AI观点。如编程成个人能力问题,可让AI写代码;用龙虾打理智能家居,整合多软件;还谈及autoresearch、模型能力断层、模型分化、开源闭源格局等内容。
港大赵恒爽团队论文:让扩散模型既拿高分又不「作弊」丨CVPR 2026
扩散模型虽能生成逼真图像,但存在“奖励作弊”问题。港大赵恒爽团队提出 GDRO 后训练方法,引入组级奖励优化机制,提升模型表现、缓解作弊,还提高训练效率,有明显工程价值。
企业级OpenClaw最强拍档来了!万亿参数的国产多模态大模型,刚刚开源发布
YuanLab.ai团队开源源Yuan3.0 Ultra多模态基础大模型,是万亿级开源多模态大模型之一。它优化训练效率,在多任务表现突出,为企业Agent AI提供支撑,还提出新算法和训练策略,全面开源推动落地。
The Batch: 918 | 智能体 AI 引发投资者恐慌
投资者担忧AI系统动摇软件制造商商业根基,致标普软件与服务指数等大幅下挫。Anthropic推出多款产品加剧风波,后与部分公司合作使SaaS类股反弹,但未收复全部跌幅。AI正重塑软件市场,SaaS未死,正迈向AI原生化。
我在手机上也能操作AI OS
作者介绍其AI操作系统,由OpenCode加newtype Profile插件及内容仓库构成。此前只能桌面端操作,现通过OpenCode服务器模式和Discord bot,实现手机与系统打通,让记忆资产随时可用,提升内容生产效率。
Nsight Python 简介
Nsight Python 是基于 NVIDIA Nsight Tools 的 Python profiling 接口,能采集 CUDA kernel 性能指标。文章介绍其环境依赖、常用 API,还给出多个示例及限制,如可与 Agent 配合,辅助写出更快的 kernel 代码。