小红书」共找到 1096 篇相关文章

产品应用7

腾讯悄悄出了个插件版“Cursor”,还跟微信程序打通了。

腾讯云发布代码助手CodeBuddy 3.0,它是插件而非IDE产品,可融入各职位工作流。其亮点是打通微信开发者工具,能利用微信知识库直出程序,作者体验后认为开发便捷,有望成创造与分发新渠道。

开源星探
算法论文8

14.7M参数,目标AP达到13.9%!FSDETR用频空融合重新定义目标检测

传统目标检测问题多,2026年4月FSDETR论文提出频空融合法,用14.7M参数获13.9% APS成绩。它有SHAB、DA - AIFI、FSFPN三个核心模块,还给出训练、推理及导出ONNX部署代码。

机器学习AI算法工程
算法论文8

陈丹琦新作:大模型强化学习的第三条路,8B模型超越GPT-4o

陈丹琦团队提出结合RLHF和RLVR优点的RLMT方法,支持在基础模型上直接使用,节省后训练成本。它让模型生成CoT,用奖励模型评价输出,使模型超越大模型,推理更像人类。

量子位
新闻资讯7

刚花完天价抢人,如今态度180度转变说AI泡沫?Meta冻结招聘遭网友群嘲:扎翻脸比翻

近日,Meta 冻结 AI 招聘,此前它刚花巨资从对手处挖人。原因是 CEO 扎克伯格担心投资无回报,且公司在重组。此前 Meta 计划投数千亿美元建数据中心,其 Behemoth 模型发布推迟。此外,报告称 95% 公司 AI 投资零回报。

InfoQ
开源动态8

扎万字檄文炮轰硅谷,Meta重磅开源30B钢炮!一台MacBook就能跑

Meta发布全新30B大模型Muse Glimmer并开源,用4-bit量化等技术让其能在本地设备运行,有五大核心超能力且采用Apache 2.0协议。同时,Meta CEO扎发表万字檄文暗讽OpenAI等,抨击AI末日论等观点。

新智元
开源动态8

Qwen3家族训练秘籍公开:思考/非思考融进一个模型,大模型蒸馏带动模型

Qwen3技术报告揭晓8款模型关键技术,采用双模式架构,训练和微调分段进行,还“大带”蒸馏数据。其融合思考与非思考模式,训练分多阶段,Qwen Chat还全量上线深度研究功能。

量子位
算法论文8

大模型能力,模型成本!Google等 | 提出递归混合框架:MoR, 大幅提升LLM计算效率

Google提出递归混合框架(MoR),融合参数共享与自适应计算。它有轻量级路由和KV缓存策略,在不同路由机制各有优劣。实验显示,MoR在性能、计算和内存效率上表现出色,有望实现“大模型能力,模型成本”。

AINLPer
开源动态8

抖音&LV-NUS开源多模态新模,以博大刷新SOTA,8B推理比肩GPT-4o

抖音SAIL团队与LV - NUS Lab联合推出多模态大模型SAIL - VL2,以中参数规模在106个数据集实现性能突破。该模型从架构、数据、训练三方面创新,后经全链路优化,在多数据集验证中表现卓越。

量子位
开源动态8

两周复刻DeepSeek-OCR!两人团队还原低token高压缩核心,换完解码器更实用

两人团队仅用两周复刻DeepSeek-OCR,复刻版DeepOCR还原其低token高压缩核心优势,还在关键任务上追上原版表现。它完全开源,无需大规模算力集群,训练方案适配中团队。

量子位
新闻资讯7

刚刚!扎写信:暗示要放弃开源路线,加入close AI行列,未来10年打造个人超级智能

扎发信称要打造并赋能个人超级智能,虽未明说放弃开源,但暗示谨慎选择开源内容,似要加入Close AI行列。Meta愿景是让个人超级智能普及,与业内部分观点不同。

AI寒武纪