「小模型推理能力」共找到 9415 篇相关文章

推荐文章8

通用Agent长啥样

视频探讨大厂做基于命令行编程工具的原因,介绍命令行Agent,剖析其等于庞大工具生态、经典Unix组合哲学与现代AI调度能力,指出通用Agent骨架由AI大脑、命令行身躯和MCP感官构成。

newtype AI
新闻资讯7

MiniMax修改开源授权被骂疯了!限制M2.7商用、强制标注来源,却没完全撤下MIT标识

近日,MiniMax M2.7 模型变更开源使用条款,收紧商业授权,引发社区热议。MiniMax 称此举为防第三方‘阉割降级’模型。但标注‘Modified - MIT’却限制商用引开发者质疑,此前 MiniMax 一直完全开源。

AI前线
推荐文章7

舍弃 VAE,预训练语义编码器能让 Diffusion 走得更远吗?

纽约大学谢赛宁团队、清华&快手 Kling 团队的研究者指出 VAE 制约当前 Diffusion 范式,提出用预训练视觉模型作语义编码器改进。介绍了 VAE 不足及 RAE、SVG 工作如何解决问题,将扩散模型从‘压缩优先’转为‘语义优先’。

机器之心
产品应用7

黄仁勋预言的100万亿市场,被易鑫金融Agent撞开一道口子

大模型在金融行业落地潜力大但门槛高。易鑫依托行业经验,推出Agentic AI解决方案,由XinMM - AM1大模型和Harness体系组合,覆盖汽车金融全链路,已在风控等场景应用,拉开效率革命序幕。

新智元
算法论文8

拒绝「降智、减配、乱收费」:面向LLM API的可信验证框架

大语言模型成AI应用基础设施,黑盒服务模式引发信任危机。研究者提出IMMACULATE审计框架,能在不暴露模型信息、仅1%额外开销下,验证黑盒LLM API执行完整性,检测违规行为,相关论文与代码已公开。

机器之心
开源动态8

阿里Qwen又悄悄放出8个开源权重,卷疯了~

阿里通义千问太卷,悄悄放出8个开源模型权重,包括体积更小的Qwen3-VL及FP8权重。这一代实现全方位升级,提供两种架构、两个版本,架构也有更新,还给出使用示例与模型权重链接。

PaperAgent
算法论文8

0.25秒识破未见攻击,这套检测方法没看过任何越狱样本 | EMNLP'26

大视觉语言模型带来隐蔽攻击面,现有检测器难平衡。中国人民大学与阿里巴巴集团联合提出Learning to Detect(LoD),不依赖攻击样本和手工规则,从模型内部激活学安全模式,实验效果好且代码开源。

量子位
新闻资讯8

刚刚,阿里CEO吴泳铭发布「ASI宣言」:超级智能才是终局!

阿里巴巴CEO吴泳铭发布「ASI宣言」,认为AGI仅是序章,ASI才是终局。阿里云有两大战略路径,通义千问家族模型性能提升,如Qwen3 - Max超越GPT - 5,各模型在不同领域有出色表现。

新智元
开源动态7

我用GLM-5肝出一个Rust版Agent系统,Opus 4.6迎来了最强开源对手。

作者实测智谱发布的GLM - 5后,用其开发出Rust版Agent系统并开源。还对比GLM - 5与Kimi 2.5、Opus 4.6,认为GLM - 5写后端能力强,让普通开发者也能用高级架构能力。

开源AI项目落地
开源动态7

The Batch: 862 | OpenAI 的重新"开放"

OpenAI 发布自 2019 年 GPT - 2 以来首个开源权重模型 gpt - oss 系列,含 gpt - oss - 120b 和 gpt - oss - 20b,为智能体应用设计,免费使用修改。介绍其输入输出、架构等,还对比了性能表现。

DeeplearningAI