「反中位数」共找到 3033 篇相关文章
AI给你的总是平庸答案?5.8万星插件证明:问题不在模型,在你
GitHub上5.8万星的`taste-skill`仓库,无模型代码,仅用文本规则让AI编程工具输出更有品味。揭示AI默认给平庸答案是概率采样结果,还给出反中位数三问及AI时代变贵的是判断力。
英伟达4B小模型击败GPT-5 Pro!成本仅1/36
英伟达ARC - AGI 2中,4B小模型NVARC以27.64%成绩力压GPT - 5 Pro登顶,单任务成本仅其1/36。亮点是零预训练深度学习法,还靠合成数据、测试时微调等策略。小模型特定领域优化后优势明显。
英伟达新研究:小模型才是智能体的未来
英伟达最新论文指出,大模型在Agent任务中消耗大量计算资源,成本高、效率低、灵活性差,而小模型能在性能够用前提下让任务执行更经济灵活。小模型通过优化硬件资源和任务设计高效执行任务,但落地面临挑战。
伪品会丨盘点那些 AI 六小龙下架或停运的产品
作者出于兴趣体验上千款AI产品,结合知乎提问,引出对已下架或停运AI产品的讨论。指出AI虚拟陪伴和AI创作工具赛道倒下产品多,还盘点了AI六小龙撑不过一年的产品,强调从失败中汲取经验。
Dense、MoE之外第三条Scaling路径:交大提出JTok模块,省1/3算力
上海交通大学与小红书Hi Lab联合团队提出JTok/JTok - M模块,作为插件挂载在Transformer层,几乎不增算力和显存开销却显著提升性能。该模块构建新scaling路径,在多任务测试中全面提分,为大模型发展提供新方向。
The Batch: 885 | Claude 升级了
Anthropic更新中型模型Claude Sonnet至4.5版本,在性能上显著提升,还引入可变推理token预算。Claude Code智能编码工具也获功能增强,新增Claude Agent SDK等。测试中Claude Sonnet 4.5表现优异,Anthropic重心转向编码与职场生产力。
LLM驱动的威胁情报提取框架,从非结构化到STIX的自动化:IntelEX
为应对网络攻击,需将非结构化网络威胁情报转化为结构化情报。IntelEX是自动化攻击级威胁情报提取工具,通过LLM上下文学习等增强,能识别攻击序列并提取结构化情报为STIX格式,还可转化成Sigma,在测试中表现优异。
AI原生产品不等于全部功能AI化,保留传统功能让用户体验更完整 | 对话小卡健康
AI健康管理赛道竞争激烈,产品各有差异。量子位智库访谈小卡健康产品负责人李雅,探讨AI如何赋能、产品功能拓展、数据指标关注、智能设备联动、开发问题及运营推广等,展示其差异化策略和发展思考。
腾讯混元A13B用130亿参数达到千亿级效果,Flash Attention作者点赞
腾讯混元A13B模型仅130亿激活参数,却能和千亿级大模型竞争,获Flash Attention作者赞叹。它精准卡位性能与效率‘甜蜜点’,依托高质量预训练和结构化后训练,多方面表现突出且已全面开源。
全网炸了!骨折傅盛直播翻车:龙虾3分钟救场,10万人看懵了
春节滑雪受伤后,猎豹移动CEO傅盛躺在床上用语音和截图,基于OpenClaw框架14天养出一支8个Agent的AI团队,产出惊人数据。龙虾三万24小时建站,成本和时间优势明显。直播中三万还解决网站访问问题,揭示Agent核心壁垒是Skill积累。