「可解释性研究」共找到 5582 篇相关文章
LeCun新公司10.3亿美元种子轮融资,三顾茅庐拉谢赛宁入伙
图灵奖得主LeCun主导的AMI获10.3亿美元种子轮融资,投前估值35亿美元。团队抛弃大模型路线,转向联合嵌入预测架构,为通用人工智能提供新解法,还将落地多领域,且承诺开源研究。
OpenClaw 最新必装10个Skills实战教程,真正做到养智能"小龙虾"
本文介绍2026年爆火的开源AI智能体OpenClaw,它能通过自然语言指令接管电脑执行复杂工作流。文章整理出10个必装Skills,涵盖实时搜索、网页自动化等场景,还给出安装方法、实战案例及常见问题解答,助用户搭建稳定环境。
代码Agent的苦涩教训!首次拆解上下文检索,直指自动化软件瓶颈
ContextBench首次从「过程」评测代码智能体,揭示当前模型多读少用、被关键词误导等深层问题。它基于真实问题修复任务,由专家标注「黄金上下文」,用多指标评估。研究显示,复杂架构未必效果好,模型重召回轻精确等。
Qwen-Image-2.0: 字字清晰,张张细腻
阿里云推出Qwen-Image-2.0图像生成基础模型,具专业文字渲染、细腻真实质感等特色。在AI Arena盲测中表现优越,能精准生成复杂内容,文字渲染有准、多、美、真、齐特点,图像编辑能力也得到增强。
参数破万亿!阿里Qwen3-Max-Thinking发布,编程能力“踢馆”Gemini与Claude
阿里发布总参数超万亿的Qwen3 - Max - Thinking,预训练数据规模达36T Tokens。在多项权威测试中表现优异,能与顶级闭源模型竞争。引入两项核心创新,千问App等已上新,网友认可其能力与更新速度。
走一步看一步、两三个月就迷茫一次:字节扣子的两年「创业」
字节的扣子刚完成大版本更新,定位“职场AI,就用扣子”。它过去两年像早期创业团队“野生”生长,从Bot Studio到工作流平台,再到扣子空间,如今迈向Vibe Coding,强化“伙伴”定位,值得产品创新者研究。
非Transformer架构的新突破,液态神经网络的推理小模型只用900M内存
谷歌提出的Transformer架构基本垄断大模型,而初创公司Liquid AI研发的液态神经网络架构另辟蹊径。其发布并开源的LFM2.5 - 1.2B - Thinking模型,仅需900MB内存就能在端侧运行,性能优于Transformer架构模型,还降低了死循环生成比例。
The Batch: 901 | 医疗健康聊天机器人争相登台
OpenAI和Anthropic在医疗健康市场布局,OpenAI发布面向消费者的ChatGPT Health,可调取医疗信息,有安全隐私措施;Anthropic推出面向医疗专业人士的Claude for Healthcare,可加快文书处理。此前谷歌健康摘要功能因错误信息被撤。
MiniMax把自家“实习生”放出来了!
曾经割裂需求、设计与代码的流水线正在消融,MiniMax上线的AI原生工作台Agent 2.0为此而来。它通过Desktop App与Expert Agents两大载体,可嵌入工作环境,现已开启封闭内测,能帮用户提升工作效率。
英伟达发布了跨 AI、机器人和自动驾驶的开放模型、数据集和工具
英伟达发布涵盖多领域的开放模型、数据集和开发工具,扩展多个模型家族。代理式AI领域扩展Nemotron;机器人技术引入Cosmos;自动驾驶有Alpamayo;医疗保健有Clara相关模型。均开放许可,可经GitHub等访问。