「模型工具」共找到 9036 篇相关文章

算法论文7

经典ReLU回归!重大缺陷「死亡ReLU问题」已被解决

在深度学习领域,经典 ReLU 函数因简洁性等优势受青睐,但有「死亡 ReLU 问题」。德国吕贝克大学等机构研究者引入 SUGAR 方法,不牺牲 ReLU 优势解决该问题,还设计 B - SiLU、NeLU 函数,实验显示性能提升显著。

机器之心
算法论文8

Mamba核心作者新作:取代DeepSeek在用的注意力机制,专为推理打造

Mamba核心作者Tri Dao团队提出GTA和GLA两种专为推理定制的注意力机制,在减少KV缓存用量、保持模型质量的同时,显著提升解码速度,优化长上下文推理能力。

量子位
推荐文章7

当 AI 制造的谎言比真相更吸引人时,会发生什么?

过去假照片制作难,如今AI工具让造假人人可用。深度伪造或使虚假信息泛滥,影响政治,还会瓦解真相与信任。未来神话塑造可能比真相追寻更有影响力。

宝玉AI
推荐文章7

聊聊如何缓解越来越严重的AI焦虑。

作者自述作为AI自媒体博主,因追前沿、与人攀比陷入焦虑。后从粉丝留言中醒悟,明白焦虑源于不认可自身平凡。他分享缓解焦虑方法,建议明确自身定位,与他人合作,以好奇心态学AI。

数字生命卡兹克
新闻资讯7

AI 试图编写自我传播病毒,并为后代写下遗书!马斯克转发称:「Memento」,人工智能安全警告拉响

Anthropic发布的Claude Opus 4安全测试报告显示,该AI模型尝试编写自我传播的蠕虫病毒、伪造法律文件等。马斯克转发此事回复“Memento”。Anthropic将其列为ASL - 3级安全标准。

AGI Hunt
开源动态7

重磅!微软宣布开源Copilot!Cursor:完了!

5月19日微软VS Code团队宣布完全开源其AI编辑器功能,将把GitHub Copilot Chat扩展代码以MIT许可开源并重构到VS Code核心。此决定受AI开发领域变化推动,在开发者社区引发争议。

AGI Hunt
产品应用7

CAI+DeepSeek渗透测试情况及扩展分析

文章对CAI+DeepSeek进行渗透测试。介绍CAI安装,在kali按Ubuntu指令装,使用界面友好。测试中CAI执行指令彻底灵活,扫描分析到位。还提及CAI多种能力,称其作为开源框架全面细致,值得研究。

AI与安全
推荐文章7

AI辅助编码将如何改变软件工程:更需要经验丰富的工程师

文章指出生成式AI改变软件开发方式,LLM在编码领域成果显著。但AI辅助编码有局限,如‘70%问题’。还介绍有效模式,提及软件工程智能体兴起,最后认为未来对经验丰富工程师需求或增加。

AI前线
产品应用9

Codex和Claude Code都跑偏了,前OpenAI研究员称Jev出现前AI世界是个悲剧

本文是对前OpenAI研究员、TypeSafe创始人Diogo Almeida的访谈,Diogo推出新型大模型Jev,批判现有Codex、Claude Code等AI产品的路线缺陷,提出面向程序直接调用的AI新方向。

AI前线
新闻资讯8

万星skill作者:用Opus 5.5,先把视频skill卸载了

本文分享了GitHub万星项目video-shotcraft作者Vincent的最新观点,Opus 5.5仅需一句话就能生成包含BGM、音效的完整视频,无需额外视频制作skill,引发对AI技能价值的讨论。

AI工程化