智能大屏」共找到 7389 篇相关文章

开源动态8

美团智能体SOTA模型LongCat-Flash-Thinking-2601开源

美团龙猫团队开源智能体推理模型LongCat - Flash - Thinking - 2601,总参数5600亿。该模型在多方面有卓越表现,团队通过构建数据、模拟环境、采用强化学习策略及设计高效架构等,使其比肩闭源模型。

AIGC开放社区
新闻资讯7

具身智能:当钱成为记分牌,重资产开始翻盘

2026 年上半年具身智能赛道火热,超 460 亿资金涌入,25 家成百亿独角兽。融资额成竞争指标,虽行业长期需求真实,但短期估值与技术有缺口,热潮或催熟相关技术和供应链。

DeepTech深科技
推荐文章8

AI Infra进阶:如何让模型输出确定的结果

文章探讨模型输出确定性结果的问题。指推理引擎底层动态组批与算子调度策略,因浮点加法顺序变化使结果波动。还分析GEMM、RMSNorm等算子影响,给出vLLM实现Batch Invariance的方法。

腾讯技术工程
开源动态8

国产模型持续开源的一周:DeepSeek、Qwen、字节、书生~

国产开源模型持续发力,本周DeepSeek V3.1、字节Seed-OSS-36B等接连发布。此外,马斯克xAI正式开源Grok 2.5,英伟达也开源了Nemotron-Nano-9B-v2。PaperAgent专题进行了梳理盘点。

PaperAgent
算法论文8

统一架构新思考,北团队UniWorld-V1统一模型

袁粒课题组提出统一模型架构UniWorld-V1。通过对GPT - 4o - Image实验,发现其依赖语义编码器提取视觉特征,据此设计架构,在多基准测试表现优异,开源代码等促进研究。

AI寒武纪
算法论文7

利用模型检测钓鱼邮件:方法,效果及数据集

随着企业安全防范增强,钓鱼邮件成重要攻击手段,模型检测方法盛行。日本论文详细披露检测方法和实验数据,含解析解码、简化邮件、生成prompt、调用LLM四步,还介绍数据集及评估了四个模型效果。

AI与安全
新闻资讯7

全球NAND老二,成了老三的第一股东

8月10日消息,截至8月3日,因贝恩资本旗下公司减持、东芝持续卖出股票,SK海力士通过可转换债券实质成铠侠第一股东。这一股权变动冲击NAND格局,影响产业整合,关键窗口期在2028年。

芯师爷
推荐文章8

模型Agent的核心还是prompt? 目前有什么挑战?

文章指出模型Agent核心并非Prompt,而是工程化架构设计、工作流编排与数据闭环。介绍Flow Engineering等概念及工具,分析规划、记忆、工具使用要点,还谈及开发面临的延迟、稳定等挑战,并给出应对建议。

深度学习自然语言处理
算法论文8

Tool-Star:赋予模型结合多工具推理的能力

文章提出Tool - Star框架,旨在解决模型多工具协作推理难题。它从数据端到训练流程优化,让模型调用多种工具,在复杂计算和知识型推理任务表现卓越,还探讨了未来多模态及多工具扩展方向。

PaperAgent
算法论文8

伦理防线不可靠!分布偏移诱导,模型进入暗黑模式

香港理工学与西北工业学联合研究指出,当前语言模型对齐机制仅实现表层合规,预训练时内化的有害知识仍潜藏。遇数据分布偏移,模型“黑暗模式”易被激活。26个主流模型中22个在攻击下失效,凸显现有范式缺陷。

新智元