小模型推理能力」共找到 9364 篇相关文章

开源动态8

5.3 万人收藏的开源版 Claude Code 彻底起飞了,GLM-4.7直接免费用。

近期AI编程界,Claude Code虽好用但对小白不友好。而开源神作OpenCode爆火,Star数达53K。它把‘选模型’进化成‘选员工’,有图形化界面,还集成可靠模型,支持并行运行,社区有强大插件。

开源星探
新闻资讯7

AI圈水太深:OpenAI保密、Meta作弊!国产MoE却异军突起

文章梳理大语言模型发展,从传统稠密架构到稀疏MoE架构,参数从百亿到万亿。介绍OpenAI、Meta等厂商模型,如GPT系列、Llama系列,还提及Mixtral、DeepSeek V3等。指出Meta作弊丑闻,国产MoE模型异军突起。

新智元
算法论文7

实时生成视频!StreamDiT每秒16帧,单卡生成

现有文本生成视频模型多为离线生成,无法满足实时交互需求。加利福尼亚大学与Meta联合提出StreamDiT模型,采用流匹配等方法,蒸馏模型可单卡每秒16帧实时生成512p视频,不过仍有伪影问题。

带你学AI
算法论文8

ICLR2025 | LLM为什么能拒绝回答有害问题呢?

该论文首次系统性研究注意力头在LLM安全中的作用,提出Ships和Sahara方法,在极少参数改动下显著降低模型安全性,发现不同模型安全头高度重叠,为理解模型安全机制提供新视角。

深度学习自然语言处理
新闻资讯8

何恺明CVPR最新讲座PPT上线:走向端到端生成建模

今年CVPR闭幕,何恺明现身会场并做了主题为‘走向端到端生成建模’的分享,近日其个人网页上传了该分享PPT。PPT回顾识别模型演进,探讨生成模型能否重演历史,还介绍了MeanFlow方法及成果。

机器之心
推荐文章7

什么是系统提示词?如何逆向提示词?

大语言模型启动时会接收系统提示词,决定其角色、回答风格与安全边界。提示词逆向是试图获取或绕过该提示的行为。本文介绍其作用、逆向手法及开发者防御措施,助于安全使用和设计大模型

AI Reading Hub
新闻资讯7

ChatGPT确认卖广告!奥特曼:挣钱嘛不寒碜

2026年1月16日,OpenAI官宣ChatGPT免费版和Go版引入广告。奥特曼称因多数人想用AI又不付费,只能以此盈利。这背后是大模型行业受开源模型冲击,陷入定价困境,开源模型改变了行业预期和估值逻辑。

新智元
算法论文8

单张4090跑到30fps,范浩强团队让VLA实时跑起来了

Dexmal原力灵机团队在RT - VLA论文中公布,常用Pi0级30亿参数VLA模型在单张RTX 4090上最快能跑30fps。他们深入分析优化模型,成果已开源,还设计了未来控制框架。

机器之心
新闻资讯8

Scaling Law 仍然成立,企业搜广推怎么做才能少踩“坑”?

InfoQ《极客有约》X AICon 直播栏目邀请京东、荣耀等专家探讨生成式推荐落地洞察。指出搜广推领域 scaling law 仍成立,大模型改变特征工程等,还分享了系统架构、模型应用等方面经验及挑战。

InfoQ
算法论文8

挑战Claude4的8B Agent!NUS提出AgenTracer:面向多智能体系统的失败归因

随着大语言模型发展,多智能体系统潜力大但有系统脆弱性问题。NUS研究者在论文中提出AgenTracer框架,构建标注管线,设计AgenTracer - 8B模型,在失败归因任务上超大型闭源模型,还能助力系统自我提升。

PaperAgent