「少即是多」共找到 5203 篇相关文章
3.9K star 惊艳!!媲美IDM,跨平台,AI加速,这届高中生牛逼了!
Ghost-Downloader-3是高中生用Python打造的跨平台多线程下载器,初衷是帮B站UP主整合资源。现具AI加速等功能,在GitHub获3.9K星,安装简单,未来还将添加磁力和BT下载。
一个模型超了DeepSeek R1、V3,参数671B,成本不到350万美元
Deep Cogito 是旧金山 AI 初创公司,开源四款混合推理模型。最大 671B MoE 模型性能超 DeepSeek v3 等,推理链比 DeepSeek R1 短 60%,训练成本不到 350 万美元。核心方法是迭代蒸馏与增强。
清华-腾讯联手:音频 - 视觉多模态任务统一框架
Crab是人大、清华和腾讯合作论文提出的模型,目标是高效一统多模态场景理解任务。它解决了音频 - 视觉理解模型任务干扰、合作显式化不足等难点,通过构建数据集、设计结构和统一架构实现多任务合作。
迟到3个月的美图Agent,RoboNeo居然有一些惊喜?
美图公司推出专注影像与设计的AI智能体RoboNeo,虽来得有点迟,但实战测评中它和星流Agent各有优劣。星流是光影与排版“偏科生”,RoboNeo是细节与执行“实干派”,适配不同需求。
阿里开源QwenLong-L1:首个以强化学习训练的长上下文推理大模型
LRMs扩展到长文本场景是挑战,阿里开源QwenLong-L1框架,是首个用强化学习训练用于长文本推理的模型。它含三个核心组件,QwenLong-L1-32B性能领先,与Claude-3.7-Sonnet-Thinking相当。
别学提示词,学逻辑
作者黄益贺认为别学提示词、别买相关课程,因其本质是通用沟通技巧,靠逻辑和方法论。还提到提示词上层是针对模型优化,但普通用户做好底层就行,靠提示词收割流量挺无聊。
Transformer | 一文带你了解Embedding(从传统嵌入方法到大模型Embedding)
文章介绍Embedding基础知识,从传统统计方法到如今大模型用例演变过程。涵盖传统、静态、上下文及大模型Embedding技术,如TF - IDF、word2vec、BERT等,还剖析DS - Qwen1.5B的Embedding并以图展示。
Agent 的第一性问题:Proactive 与 Context 经济学
过去一年AI Agent能力提升,但用户体感未同步变好,原因在于人类注意力窗口有限。赛道分化,主动式桌面Agent是新方向,AirJelly是代表产品,五源资本对其创始人黄柏特进行访谈,探讨产品设计、应用场景等问题。
诺奖得主辛顿最新访谈:1 万个 AI 可以瞬间共享同一份“灵魂”,这就是为什么人类注定被超越
诺奖得主“AI 教父”杰弗里·辛顿在播客节目中,用通俗比喻讲 AI 发展底层逻辑。指出 AI 没“幻觉”是“虚构”,反向传播本质是“连坐”,数字智能优于生物智能,还探讨了 AI 超越人类、失控等问题。
Agent 真正的护城河,正在从工具转向记忆资产
2026年初,Anthropic用Claude Cowork引发AI创业热点,其计划引入知识库获“永久记忆”能力,将Agent Memory探索推到前沿。文章探讨独立Memory层成必需品的原因、工程化记忆系统的能力,还对比模型厂商和第三方中立派路线。