「X推荐算法」共找到 1179 篇相关文章
性能不减,吞吐量提升6.4倍!英伟达用混合算子和架构定义小模型新标准
NVIDIA研究团队通过Nemotron - Flash系列模型,打破对‘深而瘦’架构迷信,修正缩放定律,用进化算法搜索混合算子、改进训练策略。该模型在性能、延迟和吞吐量上表现出色,远超同类产品。
OpenAI认怂了:ChatGPT推广告?我们真没这意思,纯属设计失误
12月1日,ChatGPT Pro付费用户界面弹出应用推荐卡片引不满。早有添加广告预兆,Sam Altman态度转变。OpenAI称是应用建议,用户不买账,功能已暂停,而同期ChatGPT商业化价值也在显现。
复旦提出自适应Reasoning方法ARM,“能屈能伸”
复旦提出自适应Reasoning方法ARM,解决LLM‘过思考’问题。ARM内置四种解题策略和三种决策模式,还搭配Ada - GRPO算法,在23个数据集测试中表现出色,省token、提速度且准确率高。
爆冷!字节Seed 在CCPC 决赛只做出一道签到题,而DeepSeek R1 直接挂零?
第十届 CCPC 举行,字节 Seed 携 Seed - Thinking 参赛,结果意外,仅做出一题,DeepSeek R1 挂零。不同模型架构表现差异不大,暴露出大模型做算法题短板,推理模式表现更好。
H100去哪儿了?
X 用户疑问引发关注,H100 供应下降成算力危机。超大规模云厂商和前沿实验室提前锁定产能,核心短缺在于内存与封装工艺。算力危机冲击 AI 生态,产业界有应对方法,但短缺问题短期内难解决。
科普向:一文解构大模型后训练,GRPO和它的继任者们的前世今生
文章深入解读大模型后训练,先对比 PPO 与 GRPO,指出 GRPO 优势及成本问题。又介绍 GRPO 后续改进算法,如 DAPO 解决训练问题、GSPO 提升训练稳定性、GFPO 可优化多属性,还提及 GRPO 其他缺陷。
两篇一样的公众号文章,为啥流量都这么高?
白杨SEO针对公众号两篇相同文章流量高的现象,解答了相关疑问,指出公众号流量本质是打开率,打开率取决于选题和标题。还介绍了推荐流量和搜索流量的逻辑及做法。
65亿「偷」来一个耳塞?OpenAI首款硬件被曝抄袭,苹果天才设计师翻车
OpenAI斥资65亿美元收购Jony Ive的AI设备初创io,却被谷歌X孵化公司IYO起诉抄袭。IYO称其产品和名字均被剽窃,此前OpenAI曾拒绝合作,却私下获取IYO技术方案。
说句话就能飞!北航发布语言交互的无人机控制模型
北航刘偲教授团队提出语言引导的细粒度无人机轨迹控制研究框架,定义Flow范式。采用模仿学习法让无人机响应指令,构建数据集和仿真评测基准,还提出协作策略和算法,实现真机部署。
Cursor 定价更新:Pro 不再限 500 次,取消工具调用限制,还推出 $200 Ultra。
Cursor进行定价更新,推出200美元/月的Ultra计划,使用量是Pro的20倍。Pro计划默认改为有速率限制的无限请求,也能切换回旧的500次快速请求模式。还推荐了4个开源LLM微调库。