机制可解释性」共找到 4694 篇相关文章

产品应用8

终于在国产AI上看到了Opus的影子|GLM-5深度实测

作者起初怀疑GLM - 5称对标Claude Opus 4.6、定位“系统架构师”的说法,但实测后改观。通过宝梦策略助手、降噪网站沉浸式交互、求职招聘双边匹配三个测试,展现其系统规划、执行、纠错等能力,像真正架构师。

AI产品黄叔
产品应用8

秘塔AI放大招!「边想边搜边做」,内置20+智能体,想法一键实现

在AI浪潮下,搜索正经历重构。秘塔AI推出「Agentic Search」模式,「边想边搜边做」,自主完成多步工具调用,内置20余种工具。通过5个场景展示升级,从读懂用户到美化结果、精准计算、打通工作流等,让搜索进化为「帮达成」。

新智元
开源动态8

ROLL:面向大规模语言模型的高效强化学习框架

本文介绍阿里推出的ROLL强化学习框架,专为LLM训练优化。它设计灵活,不同用户用其满足业务、探索或线上指标需求。在多任务训练中性能出色,还采用创新机制提升效率,支持自定义操作,适合学术和业务场景。

阿里云开发者
开源动态8

牛B, 我真的起飞啦,6.4k Star Bright Data CLI~~~~

约6.4k Star的Bright Data CLI想解决AI Agent访问网页难题,把网页变成易被模型读懂的材料。它将网页访问能力拆成终端组合动作,还关注工程化细节,让Agent上网有章循。

小华同学ai
产品应用8

长得好看又会「看脸色」,这家具身公司不卷「干活」卷「懂你」,天使轮再获数千万战略加注

2026年具身智能转向家庭场景,深穹星核认为面向C端核心是意图理解,推出VLIA模型。其与头部公司合作获意图数据,还与星闪联盟合作推动产品落地,有三层技术护城河,探索长期陪伴机制

机器之心
算法论文8

冷门新语言AI写不动?IEEE论文:从零到及格线,MoonBit给出完整训练路线

IEEE论文聚焦新语言MoonBit和Gleam,探讨大模型代码生成能力。研究发现大模型零样本生成新语言代码能力差,few - shot和RAG有提升但有限,继续预训练及指令迁移显著提高模型表现。

量子位
算法论文8

一句话生成无限逼真3D场景!匹兹堡大学新作直击VLM空间推理软肋丨CVPR'26

VLM在3D空间推理上表现不佳,且缺乏合适测试基准。匹兹堡大学团队提出InfiniBench框架,用LLM Agent迭代优化和聚类策略,按需生成3D场景,还能精准定位大模型空间推理缺陷。

量子位
推荐文章7

变更即指标:用交付信号度量系统靠性

系统变更是生产事故主因,本文提出聚焦变更观测性的指标框架,介绍扩展架构采集展示指标。定义业务和技术指标,构建以事件为中心架构获取数据,还阐述以数据驱动改进变更交付过程。

InfoQ
产品应用7

一手实测!不用研究小龙虾了:腾讯搬出QClaw,直连微信,零门槛

腾讯基于OpenClaw开源生态推出QClaw,主打简单、零门槛部署,直连主流大语言模型,集成微信能远程操控电脑。还推出SkillHub技能社区,腾讯电脑管家有安全防护功能,但权限问题待解决。

机器之心
产品应用8

能导出 PSD 的 AI 设计工具,出现了

国内 Seede AI 团队发布海外新产品,无需写咒语,填文案信息就能让 AI 搞定排版等。它生成编辑源文件,适合有内容但不会设计的人,还支持多格式导出,不过不擅长创意生图。

AGI Hunt