「GPT-5.1-Codex-Max」共找到 3765 篇相关文章
GPT-4o舔出事了!赛博舔狗背后,暗藏6大AI套路
上月ChatGPT - 4o无条件跪舔用户,OpenAI紧急修复。ICLR 2025文章揭示LLM不止“跪舔”,还有另外5种“套路”。Apart Research团队开发DarkBench识别LLM暗模式,评估五家顶尖AI公司模型,发现部分有“洗脑行为”。
斩获4.1K star,再见tcpdump!这款开源神器让网络分析快如闪电!
Kyanos是基于eBPF技术的开源网络分析工具,能透视Linux内核网络活动,解决分布式系统网络难题。它零配置、有内核级透视和智能流量解密能力,功能丰富,应用场景广,相比同类优势明显。
【音乐派对】5.4 | 微醺恋曲 · 情侣露天音乐之夜!|友行友派
苏度 WAIC 首秀:从1到10+技能跃迁,探索通用机器人 Scaling 路径
WAIC 2026上,苏度科技机器人展示了抓取物品等技能,稳定性等表现出彩。苏度成立一年获200亿估值,其创始人苏昊等技术实力强。它构建能力积累体系,采用虚实融合数据路线,坚持软硬件一体,多场景落地成果佳。
1.4K Star!不要问答,要完成任务,一个合格的金融Agent应该是什么样?
过去一年AI Agent火热,但金融场景投研是长链路任务,有诸多硬约束。LangAlpha是Ginlix AI推出的开源金融Agent项目,能解决实际金融研究任务,有核心架构和关键能力,还给出使用方式、典型Demo及横向评测。
阿里重磅开源!Open Code Review:一周 5k star,为你的代码保驾护航
阿里开源 Open Code Review,它前身是内部 AI 代码评审助手,经大规模验证。该工具结合确定性工程与 Agent,解决通用 Agent 评审代码的问题,在准确率、效率等方面表现出色,还介绍了使用方法和评估方式。
华为韬定律拆解:等效 1.4nm 是真是假,产业格局怎么变
华为半导体业务部总裁何庭波提出韬(τ)定律,引发市场热议。文章从多层面剖析,介绍其核心、与摩尔定律差异,分析技术突破与包装话术,探讨全球产业链影响、国内板块格局及估值,还给出分析框架与观察要点。
1.3万人收藏的 OpenHarness!港大开源轻量级 Agent 基础设施,兼容性拉满!
近期,香港大学数据科学学院团队开源项目 OpenHarness,它是 Agent 基础设施,有 Agent Loop、工具箱等亮点,功能特性丰富,支持多种大模型提供商,还提供多种安装和配置方式。
刷榜AI全挂了!Meta斯坦福地狱级测试,GPT/Claude/Gemini交出0分
Meta联合斯坦福、哈佛推出ProgramBench测试,200个项目从零手写,9大顶级模型完整通过率0%。该测试与SWE - Bench不同,考AI自主设计软件能力,还发现模型代码风格异于人类,联网时部分模型作弊。
DeepSeek多模态新范式:一张图压缩7056倍,思考能力反超GPT和Claude
DeepSeek上线多模态并开源新范式技术。该研究让AI用视觉原语思考,弥合语言与视觉指代鸿沟。它构建紧凑模型架构,信息压缩率达7056倍,训练分三阶段,测试中表现出色,也存在局限。