「悟界大模型」共找到 9211 篇相关文章
DeepSeek开源的文件系统,是如何提升大模型效率的?
2月28日,DeepSeek开源高性能分布式文件系统3FS以解决人工智能训练和推理挑战。介绍了分布式文件系统优势,深入解读3FS的组件、CRAQ协议等,还探讨其与其他系统差异及性能相关问题。
推理快30%,性能超过千亿参数模型,15B模型Apriel-1.6重新定义端侧推理
ServiceNow人工智能团队发布的Apriel-1.6-15b-Thinker,以150亿参数体量,多模态推理能力强,推理Token消耗降超30%。它在AI分析指数成绩佳,优化计算成本,还介绍了训练策略与多维度性能实测情况。
在Claude桌面版里用任意模型
现在Claude桌面版可使用任意模型,这是4月官方更新添加开发者模式带来的功能。文中介绍了操作方法,还称Claude桌面版是世界最好的AI客户端,覆盖多种使用场景,推荐大家使用。
Claude Code 推出 /Ultraplan,超级计划模型
Claude Code 推出 `/ultraplan` 功能,在写代码前提供可视化方案,可编辑、审批。还发布了 Claude for Word 集成微软 Office 套件。Anthropic 迭代快或因内部使用更强的 Mythos 模型。
刚刚,全球视频模型新王诞生了!
天工AI的SkyReels-V4直接登顶Artificial Analysis文转视频全球榜,超越Veo 3.1、Sora 2。其相比之前有两大核心升级,让视频生成从‘生成片段’走向完整视频生产,还应用于短剧平台DramaWave。
打工15年,被大厂裁4次了
美国老李15年被微软、Meta、苹果等大厂裁4次。2025年众多科技公司裁员,AI推动岗位变革,企业用懂AI员工换不懂的。失业潮全球都有,有人转型成功,老李最终入职丰田子公司。
Life of a Token:像调试代码一样看懂大模型如何生成 Token
文章类比 Chrome 的 Life of a Pixel,追踪 LLM 里 token 从输入到输出的全程。以 GPT - 2 Small 为例,详细讲解其管线各阶段,如 Tokenization、Embedding 等,还介绍了残差流、KV Cache 等概念及 GPU 性能瓶颈和优化方法。
让大模型指哪打哪的Multi-Agent路由新范式
随着MCP生态兴起,一个Assistant背后可能挂数百工具/子Agent,传统检索方式有成本高、埋没工具等问题。作者提出Tool-to-Agent Retrieval新范式,实验显示指标全面提升,证明工具细节能补足语义。
大模型公司不搞浏览器搞Agent,实测找到原因了
文章实测阶跃星辰桌面Agent小跃,它能操作命令行,可自然语言驱动计算机功能,有悬浮球形态,能联网、搜索、处理表格等,还支持复用操作、定时任务,但也存在速度慢等不足。
SEO->GEO?大模型时代如何构建人类获取信息新范式
文章指出百度信息入口根基被侵蚀,或被DeepSeek替代。还阐述互联网大势格局,如基模最终收敛,互联网盈利模式从用户免费-营销付费向用户付费转变,高价值真实信息将重构互联网。