「AI处理长文本」共找到 10506 篇相关文章
小扎狂砸3亿美金薪酬包!奥特曼放狠话:传教士终将打败雇佣兵
新智元报道,Meta挖走近十位OpenAI研究员,小扎砸3亿美金薪酬包。奥特曼内部喊话“传教士将打败雇佣兵”,抨击Meta挖人,还暗示评估薪酬方案。当前硅谷AI抢人大战白热化,人才薪酬暴涨。
Adaptive Reasoning Model:Qwen3混合思考->字节AdaCoT->清华AdaThinking
文章介绍三种处理混合思考模式的方法,阿里 Qwen3 通过 SFT 让模型具备思考能力,但需人为控制;字节 AdaCoT 和清华 AdaThinking 让模型自主决定是否思考,分别用多目标优化和受限优化目标训练。
专为终端设计 ,轻量快速,GB 大文件都秒开!
开源君发现一款基于 Rust 的终端文本编辑器 `Fresh`,目标是轻量、快速、功能强大,支持多平台,有7.1k+ star。它上手0门槛、轻量快速,有代码友好功能和丰富生产力工具,还支持插件扩展,提供多渠道安装方式。
当亚马逊云科技拿到“麦克”,一年的云计算叙事都被改写了
2025亚马逊云科技re:Invent大会上,CEO Matt Garman围绕Agentic AI落地发布系列新品。其认为落地需四大支柱,亚马逊云科技带来如芯片、模型等成果,还强调私有数据及开发者工具重要性,多个企业已实践应用。
重磅!华为何庭波正式提出τ缩放定律,晶体管密度直指1.4纳米,麒麟2026首发验证
2026年,华为何庭波提出τ缩放定律,主张将时间常数τ作为半导体演进首要优化目标。该定律在手机端和AI数据中心验证有效,还涉及产业结构变化,但仍有工具链、工艺变异等问题待解。
没等VC下场,机器人厂商们先投了一家数据公司
2026年具身智能市场火热,智域基石获灵初智能等四家企业数千万元天使轮融资。其定位第三方数据公司,核心团队背景互补,明确不做本体、模型等四件事,还构建自动化编译管线处理数据。
一封误发「死亡日历」,引爆亚马逊16000人大裁员
一份意外泄露的日历会议邀请提前引爆亚马逊裁员恐慌。官方宣布再裁约1.6万个岗位,涉及多业务。此次裁员是组织调整与效率革命,也受AI影响,凸显行业变革下普通人职业挑战。
前OpenAI CTO企业遭重创!办公室偷情致团队崩盘,核心3人叛逃OpenAI
2026年1月,前OpenAI CTO Mira Murati创办的Thinking Machines Lab遭遇重创。联合创始人Barret Zoph因办公室恋情被降职后逼宫索权,遭拒被开除,随后与两名骨干叛逃OpenAI。这揭示了AI人才战争的残酷。
社区供稿丨如何抑制大模型的“过度反思”:Yuan3.0 Flash 中的强化学习范式
大模型在企业落地时存在“过度反思”问题,浪费算力。YuanLab.ai团队在Yuan3.0 Flash模型中提出RIRM与RAPO,前者奖励“思考过程”,后者优化训练框架,实现推理效率提升,适用于企业场景。
英伟达开源全新大模型:黄仁勋不想只「卖铲子」
2025年底英伟达宣布开源全新模型家族Nemotron 3,含Nano、Super和Ultra。它融合Mamba、Transformer和MoE技术,有诸多创新。这不仅是产品更新,更是战略突袭,标志着英伟达想构建AI闭环开放生态。