免费token」共找到 1044 篇相关文章

开源动态8

SimpleTIR:让大模型“边写代码边思考”不再崩溃

SimpleTIR可解决多轮工具调用中训练崩溃问题。作者指出崩溃原因是分布偏移、低概率token链式雪崩和梯度爆炸。它采用void turn过滤,掐断崩溃链路,训练稳定,还催生多样推理行为,且工程友好已开源。

AI科技评论
产品应用7

GPT-5 在 Lovable/Vibecode 中氛围编码,附 GLM-4.5 对比 (反向搜索引擎、吵架的俄罗斯方块)

文章展示GPT - 5在网页端、Lovable、Vibecode的测试案例,与GLM - 4.5对比。如GPT - 5在WebDev Arena创纪录,不同版本使用限制不同。还列举多个应用案例,指出GPT - 5有不足,GLM4.5全栈开发表现不错。

AI进修生
推荐文章7

人生周报v035:我和你

本周人生周报分享了即刻、X平台上对AI时代产品与服务、人性、社区氛围等观点,推荐《我和你》,还输出对生活、思考、创作等方面感悟,如把一天当一生过、当答案免费问题无价等。

李继刚
产品应用8

让你抄袭都跟不上节奏

最近 Dia 连更两小版本,推出 Skills Gallery 和 Research 功能,即扩展技能库和深度研究能力。它更新似微信,节奏快创意足,让对手难抄袭。目前免费,仅 M 芯片苹果电脑可用,文末有邀码获取方式。

MacTalk
产品应用7

R2没来,却等来综合性能更优的DeepSeek R1T2

抱抱脸热门排行榜出现R1变体模型DeepSeek-TNG-R1T2,构建于多个父模型之上,在智能与输出token长度间达新平衡点,速度快且测试表现佳,还给出与不同模型对比的选择建议。

PaperAgent
新闻资讯7

小米小爱同学:资源受限下,实现端侧大模型的高性能推理

InfoQ对话小米小爱同学端侧AI负责人杨永杰,探讨大模型端侧部署难题。团队自研推理框架,实现180 tokens/s推理速度,采用共享基座架构支持多业务。未来端侧大模型突破依赖硬件提升与架构演进。

AI前线
开源动态8

MetaShuffling:Meta的Fused MoE kernel工程方案,更激进的Kernel优化和尽量避免Padding

文章介绍Meta的Fused MoE kernel工程方案MetaShuffling,可高效部署Llama 4模型。它处理MoE推理挑战,介绍多种token选择路由方案,阐述运行时设计、不同并行化方式及优化思路,还展示性能测试与Trace分析。

GiantPandaLLM
开源动态8

小扎万字檄文炮轰硅谷,Meta重磅开源30B小钢炮!一台MacBook就能跑

Meta发布全新30B大模型Muse Glimmer并开源,用4-bit量化等技术让其能在本地设备运行,有五大核心超能力且采用Apache 2.0协议。同时,Meta CEO小扎发表万字檄文暗讽OpenAI等,抨击AI末日论等观点。

新智元
开源动态8

手机跑多模态也能快到飞起!面壁MiniCPM-V 4.6开源

面壁智能开源多模态模型MiniCPM-V 4.6,以低算力成本、超低首Token延迟打通三大主流手机操作系统。它算力瘦身性能强,是视觉语言多面手,还适配主流系统,降本增效,让AI能力从云端到指尖。

AIGC开放社区
开源动态8

OpenClaw 背后核心框架 Pi:好的 Coding Agent 应该让用户来决定需要什么

OpenClaw 背后核心框架 Pi 是极简框架,系统提示词和工具定义不到 1000 tokens。开发者 Mario 认为好的 coding agent 应让用户决定需求。Pi 不支持 MCP 等,在 Terminal Bench 2.0 排名靠前,GitHub 星数超 24000。

Founder Park