「AI使用」共找到 10342 篇相关文章
更新啦!我用 Claude Skills 做的剪辑 Agent!识别效果+交互大升级
作者成峰根据用户反馈对剪辑 Skills 做了大改,替换火山引擎音视频识别模型、提升交互界面。改进包括用 API 替代本地模型、重构口误识别系统、设可视化审核界面,还介绍了简单使用方法。
0.005%参数量超越SOTA!提升模型能力无需庞大奖励模型
上海交通大学等校联合团队提出轻量级奖励模型SWIFT,利用大模型隐藏状态线性特征,仅训练极小线性层,在推理任务中超越主流奖励模型,实现计算效率与准确率双提升,且在多领域表现出色。
推出 AnyLanguageModel:在 Apple 平台统一本地与远程大语言模型的 API
大语言模型是构建现代软件的重要工具,但 Apple 平台开发者集成模型困难。Hugging Face 发布 AnyLanguageModel,是 Swift 包,可替代 Apple Foundation Models 框架,支持多模型服务商,降低使用 LLM 难度。
Anthropic:大模型开始意识到自己在想什么!
Anthropic的Jack Lindsey论文《Emergent Introspective Awareness in Large Language Models》对大模型做神经科学受控实验。发现Claude Opus 4/4.1能感知内部念头,区分内外状态,通过检查内部状态一致性判断输出意图。
穷人福音!MIT研究:不用堆显卡,抄顶级模型作业就成
MIT研究把59个不同模型凑一起,发现强大模型对物质理解趋同,且性能越强思维越接近。研究还指出性能不佳模型的问题,认为可通过模型蒸馏让小模型模仿大模型,实现算力自由。
Claude 4.x 的提示工程实战指南
Anthropic在官方文档上线Claude 4.x提示工程指南,针对4.5系列模型优化。介绍基本原则、长期推理和状态跟踪方法、沟通风格,还给出特定场景指导及迁移考虑,助你发挥Claude 4.x实力。
谷歌2025年终回顾:Gemini 3领衔,六大领域全线突破
本文回顾谷歌2025年发展,从Gemini 1.5 pro开始有变化,到Gemini 2.5 pro质变。谷歌在模型、产品、创意、科学等六大领域突破,如Gemini 3系列模型表现出色,但Sam Altman仍认为谷歌失败。
Lovart:设计界的Cursor,NanoBanana Pro遇上真正的Design Agent
Google的Nano Banana Pro能力亮眼,但作为设计工具商用不足。Lovart像设计界的Cursor,提供专业化设计工作流,是可用的Design Agent。文中通过案例展示其编辑能力,还介绍了PPT生成等功能及圣诞活动。
15.1k,谷歌Notebook LM本地开源替代!
Open Notebook是开源、本地化且重隐私的Google Notebook LM替代方案。它支持超16家供应商,能整理多模态内容、生成专业播客,在多方面比Google Notebook LM更具优势。
社区供稿丨以小博大!Nanbeige4-3B重磅开源:硬刚Qwen3,挑战小模型能力新高度
近年来大语言模型发展陷入‘参数军备竞赛’,成本高昂。Boss直聘南北阁实验室发布Nanbeige4 - 3B,仅30亿参数,在预训练和后训练阶段采用多种创新技术,在多方面媲美甚至超越大模型。