「DeepSeek - V3.2」共找到 3896 篇相关文章
开盘大涨416%,市值近3000亿元,“国产GPU第一股”今日上市
12月5日,“国产GPU第一股”摩尔线程登陆A股,开盘大涨416%,市值近3000亿。它成立五年成国内代表企业,有全栈自研能力。不过,也面临国际巨头、国内竞品、供应链等挑战,且尚未盈利。
Ilya罕见发声:大模型「大力出奇迹」到头了
Ilya大神在近2万字采访中称,AI正从「规模时代」走向「科研时代」,主流「预训练 + Scaling」路线遇瓶颈。他还探讨了AI泛化、安全对齐、预训练范式等热门话题,给出独特见解。
数据智能体全景报告发布!你的数据智能体在哪个 Level?
大语言模型爆发让「数据智能体」应运而生,但概念笼统成发展绊脚石。由多顶尖机构组成的联合团队发布论文,首提 L0 - L5 六级自主性分级标准,还对现有研究回顾审视,指明挑战并描绘未来图景。
不只是行业 Know-How,营销类 Agent 工程化落地难题有何解?|对话瓴羊副总裁、友盟+总经理毛波
今年是“AI Agent 元年”,营销 Agent 热门但有难题待解。InfoQ 对话瓴羊副总裁毛波,探讨营销 Agent 落地困境、工程化挑战、未来护城河及发展机会,友盟+推出产品并提供方案助力解决问题。
X上63万人围观的Traning-Free GRPO:把GRPO搬进上下文空间学习
年初 DeepSeek - R1带火大模型强化学习,GRPO成常见RL算法,但训练成本高。腾讯优图论文提出Training - Free GRPO,将GRPO训练范式迁移到上下文学习,成本低、泛化好,已开源。
今天,好像见证了属于SD时代的消亡。
liblib宣布升级到2.0,作为国内最大SD生态开源社区,其转型宣告SD时代落幕。曾几何时,SD让普通人感受AI绘图魔力,如今技术迭代,AI绘图门槛降低,新模型受大众青睐。
The Batch: 884 | Transformer获得新能量
弗吉尼亚大学等机构的研究人员提出 Energy-Based Transformer(EBT),它能检查自身输出。训练时通过能量值优化预测概率向量,测试显示其泛化优但生成特定文本差,扩展性好,为高性能带来新可能。
面向高效异构训推的统一通信库DeepLink DLSlime开源
上海人工智能实验室开源异构芯片通信库 DLSlime,作为 DeepLink 核心组件,它连接多应用和传输链路。具备异构互联、多链路支持等亮点,性能优于主流方案,已在实验室多个项目验证,还助力国产 AI 工具链发展。
苹果端侧AI两连发!模型体积减半、首字延迟降85倍,iPhone离线秒用
苹果在Hugging Face放出FastVLM与MobileCLIP2两条多模态主线。前者主打「快」,首字延迟压到竞品1/85;后者突出「轻」,体积减半。模型和Demo已开放,开发者可集成开发。
Nano Banana 邪修之王最强科研成果!教你自定义生图比例!
Nano Banana 出图有分辨率低和比例不可控问题。作者发现用垫图方式可控制其生图比例,已生成图片也适用,还给出操作方法、提示词,介绍不同平台效果及案例图下载方式。