「多阶段推理系统」共找到 4051 篇相关文章
爆发力超越波士顿动力液压机器人,PHYBOT M1实现全球首次全尺寸重型电驱人形机器人完美拟人态后空翻
动易科技的全尺寸人形机器人PHYBOT M1实现全球首次全尺寸重型电驱机器人完美拟人态后空翻,其爆发力超波士顿动力Atlas。这是对其动态性能的压力测试,电驱系统也在多方面超越液压方案。
Claude Code 推出插件功能
Anthropic宣布Claude Code支持插件系统,开发者用一条命令就能安装定制化工具集合。插件把斜杠命令等打包,可按需开关。使用简单,已有多种插件,还能自行创建和托管,插件功能或成其生态重要进化。
刚刚,智谱开源了他们的最强多模态模型,GLM-4.5v。
智谱接连开源GLM - 4.5和GLM - 4.5V,后者为多模态模型,总参数106B,在42个评测基准中41个达到SOTA。经测试,它视觉推理强、速度快,还有视频理解等功能,API定价良心,体现持续开放精神。
全网开测GPT-oss!技术架构也扒明白了
全网开测GPT-oss,它登顶开源模型王座,性能比肩o3-mini、o4-mini,适合本地推理。网友探索出多种用法,还推出Pro版。其架构也被扒出,官方介绍了微调方法,吴恩达等大佬也参与测评。
GPT-5将揭示人类的"创造力"其实就是模式识别?
有传言GPT - 5将发布,X上一博主称其或揭示人类‘创造力’是模式识别,引发热议。有人认为创意是碎片重组,也有人坚持创造力不只是模式识别,还需推理等,AI完美识别模式反被困住。
GPT-5被意外泄露,奥特曼宣布即将发布!
一则GPT - 5被意外泄露的消息引发关注,SecureBio的github配置文件中出现相关内容,暗示要把‘推理’提升到新高度。OpenAI CEO等暗示GPT - 5即将发布,但不打算短期内推出有IMO金牌级别数学能力的正式产品。
大模型玩不好数独?!Transformer作者初创公司公布排行榜:o3 Mini High“变异数独”正确率仅2.9%
Transformer作者初创公司Sakana AI公布AI解决数独能力排行榜,用全新基准Sudoku - Bench考验大模型创造性推理能力。结果显示大模型总体正确率仅15%,9×9数独中高性能模型o3 Mini High正确率2.9%。
1篇长文 = N张小红书爆款图?!Gemini 2.5 Pro 这效率,我跪了!
作者作为小红书小号主,苦于长文转图难,用Gemini 2.5 Pro Preview 05 - 06实现了一键转换。文章分享提示词结构、使用方法、修改方式,还介绍用AI调风格,指出系统有生成不稳定和下载问题。
能识图、看视频,也能理解软件界面:蚂蚁百灵开源Ling-3.0-flash-VL
本文介绍蚂蚁百灵开源的多模态大模型Ling-3.0-flash-VL,该模型采用稀疏混合专家架构,支持图片、视频、软件界面理解,可将视觉信息用于推理与任务执行,开放权重采用MIT许可证供开发者部署测试。
DeepSeek 把 Harness 开源了:模型、工具、Agent Loop 全是插件
8月13日,DeepSeek面向全球开发者开放DeepSeek Harness开发者预览版v0.1并开源代码。其特色是一切皆插件,提供四种运行模式,内置多Agent系统,有创新但编排范式未突破,还采用仅追加的会话日志。