企业大模型」共找到 9889 篇相关文章

新闻资讯7

受够了 Copilot 的“霸王条款”?GitHub 全球宕机遭怒骂,引爆开发者“逃离”!

几个小时前 GitHub 面积宕机,引发开发者抱怨。虽未明确原因,但不少人猜测与 Copilot 有关。近期企业和个人开发者也在‘逃离’GitHub,如 Gentoo Linux 因 Copilot 强制启用争议计划迁移代码库。

InfoQ
7

星标超 29 万,OpenClaw 两天两次更!适配GPT 5.4,告别“抽卡式 Prompt”

GitHub星标超28万的AI Agent开源项目OpenClaw,在周六与周日迎来两轮重量级更新,集中在模型能力、Agent架构、工程部署及安全机制四个方向。2026奇点智能技术会将邀专家探讨其产业实践价值。

AI科技大本营
产品应用7

Claude杀入Office全家桶,全球4.5亿打工人一夜变天!OpenAI惨烈出局

微软推出办公神器Copilot Cowork,全面接管Office。它内置Claude模型,能执行任务、运行工作流,可处理日程、会议准备等场景。微软采用多模型策略,抛弃OpenAI,Copilot Cowork适合企业,价格较高。

新智元
推荐文章7

听说,家都在梭后训练?最佳指南来了

模型时代,Scaling Law 边际效益递减,业界转向后训练。《Post-training 101》博客可助初学者入门,涵盖从预训练到指令微调、SFT 原理、多种强化学习技术及模型评测方法等内容。

机器之心
算法论文8

微软:LLM上下文学习并非真的学习!

微软研究指出模型上下文学习(ICL)虽数学上符合学习定义,但只是拟合prompt内统计规律,非掌握任务本质。通过量实验,得出如例子越多模型表现越好、语言不重要统计重要等7条关键发现。

PaperAgent
推荐文章7

为什么 AI 搞不定体力活——对话清华学刘嘉:这才是生物智能最难攻克的“万里长征” | 万有引力

本文是对清华学刘嘉教授的访谈。他回顾 AI 研究经历,谈 AI 寒冬、研究错误及第一性原理,还分析学术界与工业界差异、AI 现状与挑战,指出模型缺创造力,人应与 AI 共进化。

AI科技大本营
算法论文8

国产芯片比英伟达整体效率更高!?华为 CloudMatrix384 超节点首曝论文,跑 DeepSeek 效率超越英伟达

今年4月,网上曾争论华为芯片效率是否超国际主流。近日华为团队论文公开,阐述在CloudMatrix 384超节点部署DeepSeek模型细节,性能指标超英伟达体系,还介绍架构、软件栈及适配优化方案。

InfoQ
产品应用8

0.3B参数,600MB内存!腾讯混元实现产业级2Bit量化,端侧模型小如手机App

腾讯混元团队推出面向消费级硬件的“极小”模型HY-1.8B-2Bit,参数量仅0.3B,内存占用600MB。它基于产业级2Bit端侧量化方案,生成速度提升,还通过多种方法提升能力,未来将探索新技术缩小与全精度模型差距。

量子位
算法论文8

扩散LLM推理新范式:打破生成长度限制,实现动态自适应调节

随着扩散语言模型成为热门,但其推理时存在预设固定长度的限制。香港中文学 MMLab 等提出 DAEDAL,赋予模型根据问题自主调整回答长度的能力,在性能和计算效率上有提升。

机器之心
产品应用8

快手发布Keye-VL-1.5,同量级SoTA,让模型真正看懂视频!

近年来,多模态语言模型兴起,但视频理解仍是难题。快手Keye团队推出Keye-VL-1.5,通过Slow-Fast编码策略、渐进式四阶段预训练和全面后训练流程等创新,实现视频理解突破,综合性能领先。

深度学习自然语言处理