「大模型自信问题」共找到 9547 篇相关文章
NanoCoder:我把50万行的claude code核心机制浓缩成1000行,不可能学不会了吧!
Claude Code 源码泄露后,kimi Agent 团队何宇峰大佬的 NanoCoder 项目,用 950 行 Python 代码重写其核心机制。它实现 7 种关键设计模式,可助理解顶级 AI 编程 Agent 核心设计,还能按需修改。
震惊!13万Star的GitHub仓库泄露了30+款AI工具的核心机密
system-prompts-and-models-of-ai-tools项目是AI界“维基解密”,收录30+款AI工具核心系统提示词。从多维度解密,有完整提示词、跨工具对比等。适用于多种从业者,还给出使用方法。
太巅了!MIT老哥在Transformer里造了台计算机,LLM从此不需要调用外部工具?
LLM在数学推理表现佳,但纯计算是短板。MIT的Christos Tzamos团队在Transformer内造计算机,实现WebAssembly解释器,解决数独难题,还突破注意力机制瓶颈,打开软件与神经网络新接口。
百度“龙虾” 全家桶亮相,多款龙虾产品上新,家用小度虾也来了
3月17日百度AIDAY龙虾专场,百度“龙虾”全家桶亮相,多款产品上新。百度集团沈抖谈OpenClaw趋势,还推出桌面AI智能体DuMate、“家用小龙虾”等,多个Skills也发布,持续降低体验门槛。
MCP已死,CLI当立!OpenClaw压根没想用它,硅谷大厂正在集体弃用。
近期Perplexity宣布弃用MCP,转而用API和CLI。MCP存在浪费Agent资源、启动易失败、权限管理差等问题。而CLI可组合、可调试、认证现成,MCP成多余中间层。
显存暴降92%!哈工大为线性注意力开辟了新道路
哈尔滨工业大学等团队发现线性注意力性能不足根源是查询范数丢失等。基于此提出NaLaFormer,在ImageNet - 1K准确率最高提7.5%,超分任务峰值内存降92.3%,为线性注意力发展开辟新道路。
CVPR'26 | 以机器人为中心的ToM推理框架,从心智推理到决策行动
吉林大学、台湾大学和微软亚洲研究院联合提出MindPower Benchmark,构建以机器人为中心的ToM推理框架,统一建模环境感知、心智推理等,还构建数据集和评估指标。引入Mind - Reward强化优化,提升ToM决策与动作生成性能。
FlashAttention-4正式发布:算法流水线大改,矩阵乘法级速度
深度学习领域底层优化技术FlashAttention更新至4版本。其核心作者称在Blackwell GPU上,注意力机制执行速度接近矩阵乘法。新算法克服瓶颈,在B200上性能提升,还获Pytorch官方支持。
阿里正式批准林俊旸辞职!CEO亲自挂帅新基模小组
昨日深夜林俊旸官宣告别Qwen,国内媒体确认其离职属实,阿里CEO吴泳铭批准。此外,周靖人继续领导通义实验室,吴泳铭等领导新小组,阿里坚持开源模型策略。
终于在国产AI上看到了Opus的影子|GLM-5深度实测
作者起初怀疑GLM - 5称对标Claude Opus 4.6、定位“系统架构师”的说法,但实测后改观。通过宝可梦策略助手、降噪网站沉浸式交互、求职招聘双边匹配三个测试,展现其系统规划、执行、纠错等能力,像真正架构师。