职场效率」共找到 1561 篇相关文章

算法论文8

上海AI Lab提出CANON:让RLVR自主识别优质推理模式

上海AI Lab与上海交大团队提出创新框架CANON,解决将人类先验知识融入RLVR训练的难题。它通过条件分组与对比机制,自适应放大有益指标变化趋势,在数学和逻辑推理任务上成果卓越,还能提升推理效率

深度学习自然语言处理
推荐文章7

图解Vllm V1系列7:使用AsyncLLM做异步推理

文章因异步RL讨论热,探讨用vllm做最小程度异步二次开发。介绍如何用AsyncLLM做异步推理,分析单条请求处理流程及阶段,说明并发提升效率的方法,还提及多请求并发及构建异步推理引擎思路。

GiantPandaLLM
产品应用7

Gemini Flash/Lite 更新:更聪明、更快、更省钱

Gemini 2.5 Flash 和 2.5 Flash-Lite 更新,可在 Google AI Studio 和 Vertex AI 上使用。相比稳定型号,预览型号质量和速度提升,效率更高,分别减少一定比例输出令牌。两版本各有优势,如 Flash-Lite 指令遵循等能力提升,Flash 工具使用性能更好。

AI进修生
技术分析类文章7

Pingpong Schedule并不是万能钥匙

SGLang社区开发者反馈,SM90 FP8 Blockwise Scaling Grouped GEMM从H20迁移至H800后性能下降。文章分析是Pingpong调度策略所致,因算力提升,其使TensorCore未充分利用、TMA效率低,建议用Cooperative策略。

GiantPandaLLM
新闻资讯7

AI摧毁就业?DeepMind CEO:这是一比互联网更猛的业洗牌

谷歌DeepMind CEO Hassabis认为AI虽可能颠覆,但会创造新工作,提高生产力。他强调学习STEM、上手AI工具的重要性,也指出AI缺乏“安全护栏”,需全球公约监管,还乐观期待AI让人类不再自私。

新智元
新闻资讯7

AI领域全新热门业,岗位需求今年已增长逾800%

在AI技术飞速发展当下,「驻交付工程师」(FDE)成连接实验室与市关键角色。他们兼具算法能力与业务洞察,深入客户现将抽象模型转化为可落地解决方案。国外企业纷纷扩充FDE团队,国内也开始有类似趋势。

新智元
算法论文8

上下文记忆力媲美Genie3,且问世更早:港大和可灵提出景一致的交互式视频世界模型

交互式长视频生成缺乏稳定景记忆,制约下游应用落地。Google DeepMind的Genie 3有强景一致性但未公开技术细节。港大和可灵提出的Context as Memory模型,上下文记忆力媲美Genie 3且投稿更早,还提升了计算效率

机器之心
产品应用8

TRAE Work 上线 Design 模式:产品经理还需要 Figma 吗?

TRAE Work 上线 Design 模式,可将一句话描述变成可编辑设计稿,还能将设计稿转代码,在同一平台完成从需求到代码的链路。作者测试后发现其效率大幅提升,并分析了该模式与其他工具的区别及 AI 设计趋势。

特工宇宙
算法论文8

抗干扰能力提升近40% !无需对抗训练,北航上海AI Lab新蒸馏方法提升模型鲁棒性 | ICML 2025

在人工智能模型规模持续扩大的今天,数据集蒸馏方法能提升训练效率、降低成本,但蒸馏模型在安全性要求高的任务中抗干扰难。北航上海AI Lab团队提出ROME方法,无需对抗训练,显著提升模型鲁棒性,成果被ICML 2025接收且已开源。

量子位
新闻资讯8

伯克利神作背刺OpenAI:持续学习才是真神!

伯克利等机构发布FST框架,通过快慢分层解决大模型持续学习死局。过去两年头部实验室都在提升模型推理能力,却忽视持续学习。FST让模型像大脑一样快慢分层,提升数据效率、减少遗忘,使持续学习可工程化。

新智元