「管理能力」共找到 3638 篇相关文章
Qwen3-Max-Thinking:会想能干,比强更强
正式推出旗舰推理模型 Qwen3 - Max - Thinking,其在多关键维度显著提升,性能媲美顶尖模型。引入自适应工具调用和测试时扩展技术,现已上线 Qwen Chat,API 也开放,还介绍了使用方法。
为什么 2025 的基模公司都押注 Interleaved Thinking?
本文探讨 2025 年基模公司押注 Interleaved Thinking 的原因。从大模型迭代说起,介绍其在多模型中的体现,阐述该思维链对 Agent 的重要性,还提及 MiniMax 在推动其成行业标准上的诸多努力及带来的影响。
Thinking with Video:一种全新的思考范式
在人工智能领域,‘用文本思考’和‘用图像思考’存在局限。复旦大学等团队提出‘用视频思考’范式,通过视频生成模型统一文本与视觉推理,构建VideoThinkBench基准测试Sora - 2,全面解读这一开创性工作。
用 Warpgate(5.8k star)在不装客户端的情况下,如何实现透明审计、统一堡垒与会话回放?
Warpgate 是完全透明的 SSH / HTTPS 等堡垒解决方案,无需额外客户端。能部署在 DMZ,提供会话录制等功能,以单一可执行文件发布,用 Rust 编写。文章介绍其痛点场景、功能、架构、上手步骤、应用场景等。
两招为GraphRAG图谱“提纯”,DEG-RAG效果有点炸~
文章指出传统RAG多跳推理和全局一致性能力受限,Graph - based RAG虽好但图谱噪音大。作者提出Deg - Rag方案,含实体消歧和关系反思两招。实验显示去噪后图谱效果提升,验证“Less is More”理念。
Anthropic:上下文工程在AI Agents的正确打开方式!
在‘提示工程’后,‘上下文工程’成焦点。它是提示工程延伸,因信息过多模型会‘失焦’,上下文是稀缺资源。文章介绍高效上下文‘解剖学’、运行时检索策略、长周期任务应对方法等。
AI PC,一场关于算力、场景与生态的远征
AI PC 市场竞争升温、格局重塑,本质是下一代计算入口争夺。英特尔通过硬件创新、生态共建等推动 AI PC 发展,在 2025 抖音商城秋上新秀展出相关产品,其酷睿 Ultra 处理器优势明显,市场呈多元竞逐态势。
浙江大学联合华为发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础大模型
2025年9月18日,浙江大学任奎教授团队联合华为在“华为全联接大会2025”发布国内首个基于昇腾千卡算力平台的DeepSeek - R1 - Safe基础大模型,提升了我国AI系统自主安全防控水平,任奎获“科研创新卓越贡献奖”。
GPT-5 最强大的,是编程
据报道,OpenAI的GPT - 5即将到来且早期反馈积极。它在编程领域表现突出,尤其在实际编程任务上有提升,不过其具体形式存疑,改进或多来自后训练阶段的强化学习。
用MoE打造DNA基础模型更强范式!人大实现seq2func全新突破
中国人民大学团队提出SPACE模型,通过引入物种感知编码器和谱系分组增强解码器,革新架构,提升了DNA基础模型性能与泛化能力,在多项测试中表现优于主流模型。