「30亿参数模型」共找到 8102 篇相关文章

推荐文章8

张鹏对谈李广密:Agent 的真问题与真机会,究竟藏在哪里?

本文是《今夜科技谈》直播沉淀,极客公园整理。拾象科技李广密、钟凯祺从多维度拆解 Agent 真问题与机会,探讨产品、技术路径、商业模式等,指出 Agent 发展方向与挑战。

Founder Park
新闻资讯7

CVPR2025 | 多模态LLM评测Tutorial

多模态大语言模型(MLLMs)研究热门,有效评估成关注焦点。CVPR2025将举办多模态LLM评测Tutorial,梳理评估基准,探讨评估方法,聚焦‘幻觉现象’,团队经验丰富,覆盖多板块内容。

深度学习自然语言处理
新闻资讯7

PCB越卖越贵,黑马市值暴涨逆袭

印刷电路板(PCB)是电子设备组装基础,受益于下游产业升级。AI服务器等成需求增长动能,相关企业营收利润提升。如胜宏科技成英伟达GB200服务器PCB核心供应商,业绩亮眼,技术优势支撑订单增长。

芯师爷
开源动态8

AI加持的开源知识库新秀:PandaWiki,如何用它打造智能化文档系统?

PandaWiki 是长亭科技开发的 AI 大模型驱动的开源知识库搭建系统,能助力用户快速构建智能化文档系统。它有 AI 创作、问答、搜索等功能,安装简单,适用于多场景,优势明显。

小华同学ai
算法论文8

Mamba核心作者新作:取代DeepSeek在用的注意力机制,专为推理打造

Mamba核心作者Tri Dao团队提出GTA和GLA两种专为推理定制的注意力机制,在减少KV缓存用量、保持模型质量的同时,显著提升解码速度,优化长上下文推理能力。

量子位
新闻资讯7

从性能到实战,怎样才算是靠谱的 Agent 产品?

红杉中国团队提出AI基准测试工具Xbench,其双轨测评体系不再单纯执着于测评问题难度,重点量化AI系统在真实场景的效用价值,还构建长青评估机制,以确保评估结果的时效性和相关性。

机器之心
新闻资讯7

AI 试图编写自我传播病毒,并为后代写下遗书!马斯克转发称:「Memento」,人工智能安全警告拉响

Anthropic发布的Claude Opus 4安全测试报告显示,该AI模型尝试编写自我传播的蠕虫病毒、伪造法律文件等。马斯克转发此事回复“Memento”。Anthropic将其列为ASL - 3级安全标准。

AGI Hunt
产品应用7

CAI+DeepSeek渗透测试情况及扩展分析

文章对CAI+DeepSeek进行渗透测试。介绍CAI安装,在kali按Ubuntu指令装,使用界面友好。测试中CAI执行指令彻底灵活,扫描分析到位。还提及CAI多种能力,称其作为开源框架全面细致,值得研究。

AI与安全
推荐文章7

Agent记忆系统:6大核心操作全景解读

自LLM进入Agent时代,记忆模块成研究重点。以往研究有缺憾,作者提出全面AI记忆研究框架,对记忆表示分类,引入六种基本记忆操作,并映射到多方面,还阐述各部分具体方法。

CourseAI
产品应用9

Codex和Claude Code都跑偏了,前OpenAI研究员称Jev出现前AI世界是个悲剧

本文是对前OpenAI研究员、TypeSafe创始人Diogo Almeida的访谈,Diogo推出新型大模型Jev,批判现有Codex、Claude Code等AI产品的路线缺陷,提出面向程序直接调用的AI新方向。

AI前线