少即是多」共找到 5203 篇相关文章

开源动态8

3.9K star 惊艳!!媲美IDM,跨平台,AI加速,这届高中生牛逼了!

Ghost-Downloader-3高中生用Python打造的跨平台多线程下载器,初衷帮B站UP主整合资源。现具AI加速等功能,在GitHub获3.9K星,安装简单,未来还将添加磁力和BT下载。

开源先锋
开源动态8

一个模型超了DeepSeek R1、V3,参数671B,成本不到350万美元

Deep Cogito 旧金山 AI 初创公司,开源四款混合推理模型。最大 671B MoE 模型性能超 DeepSeek v3 等,推理链比 DeepSeek R1 短 60%,训练成本不到 350 万美元。核心方法迭代蒸馏与增强。

机器之心
算法论文7

清华-腾讯联手:音频 - 视觉多模态任务统一框架

Crab人大、清华和腾讯合作论文提出的模型,目标高效一统多模态场景理解任务。它解决了音频 - 视觉理解模型任务干扰、合作显式化不足等难点,通过构建数据集、设计结构和统一架构实现多任务合作。

CourseAI
产品应用7

迟到3个月的美图Agent,RoboNeo居然有一些惊喜?

美图公司推出专注影像与设计的AI智能体RoboNeo,虽来得有点迟,但实战测评中它和星流Agent各有优劣。星流光影与排版“偏科生”,RoboNeo细节与执行“实干派”,适配不同需求。

鲸选AI
开源动态8

阿里开源QwenLong-L1:首个以强化学习训练的长上下文推理大模型

LRMs扩展到长文本场景挑战,阿里开源QwenLong-L1框架,首个用强化学习训练用于长文本推理的模型。它含三个核心组件,QwenLong-L1-32B性能领先,与Claude-3.7-Sonnet-Thinking相当。

PaperAgent
推荐文章7

别学提示词,学逻辑

作者黄益贺认为别学提示词、别买相关课程,因其本质通用沟通技巧,靠逻辑和方法论。还提到提示词上层针对模型优化,但普通用户做好底层就行,靠提示词收割流量挺无聊。

newtype AI
推荐文章7

Transformer | 一文带你了解Embedding(从传统嵌入方法到大模型Embedding)

文章介绍Embedding基础知识,从传统统计方法到如今大模型用例演变过程。涵盖传统、静态、上下文及大模型Embedding技术,如TF - IDF、word2vec、BERT等,还剖析DS - Qwen1.5B的Embedding并以图展示。

AINLPer
产品应用7

Agent 的第一性问题:Proactive 与 Context 经济学

过去一年AI Agent能力提升,但用户体感未同步变好,原因在于人类注意力窗口有限。赛道分化,主动式桌面Agent新方向,AirJelly代表产品,五源资本对其创始人黄柏特进行访谈,探讨产品设计、应用场景等问题。

五源资本 5Y Capital
新闻资讯8

诺奖得主辛顿最新访谈:1 万个 AI 可以瞬间共享同一份“灵魂”,这就为什么人类注定被超越

诺奖得主“AI 教父”杰弗里·辛顿在播客节目中,用通俗比喻讲 AI 发展底层逻辑。指出 AI 没“幻觉”“虚构”,反向传播本质“连坐”,数字智能优于生物智能,还探讨了 AI 超越人类、失控等问题。

AI科技大本营
推荐文章7

Agent 真正的护城河,正在从工具转向记忆资产

2026年初,Anthropic用Claude Cowork引发AI创业热点,其计划引入知识库获“永久记忆”能力,将Agent Memory探索推到前沿。文章探讨独立Memory层成必需品的原因、工程化记忆系统的能力,还对比模型厂商和第三方中立派路线。

Founder Park