大模型平台」共找到 9821 篇相关文章

产品应用7

数字技术工人已到岗!时序模型+Agent已掌握了工厂生产管控技术,比人类更懂工况

基于时序模型和Agent的数字技术工人,能承担生产操作等关键任务,接手复杂工业环节。国内AI团队打造的河谷平台构建智能体,自研底层技术,以工艺维度训练,上岗快,极峰科技还创新商业模式。

量子位
产品应用7

消费级显卡跑模型训练门槛再降:Qwen3-1.7B强化学习只需5GB显存

消费级显卡跑模型训练门槛再降,Unsloth AI的FP8精度强化学习方案让Qwen3 - 1.7B的GRPO训练只需5GB显存且性能无损。该方案与TorchAO合作,有推理优势,还在内存优化等方面表现出色。

AI工程化
新闻资讯8

10人创业团干翻行业“潜规则”!全员必须会AI、让跑模型全程“裸奔”,谷歌老兵不烧钱创业

谷歌老兵Bryan Zhou投身AI创业,组建AnyInt团队。该平台定位AI Infra中间件,一个API对接所有模型,提倡“去中心化”。团队一开始就奔着付费用户,还做了极致性能优化,吸引众多开发者。

AI前线
新闻资讯8

港股AGI第一股“云知声”首战告捷:模型贡献1亿收入,单客价直线提升116.2%,AI保险业务暴涨1386.8%

云知声发布《2025中期业绩报告》,亮点颇多。总收入4.05亿元,同比增20.2%,山海模型收入近1亿,增幅457%。业务布局呼应国务院‘人工智能+’行动,技术优势明显,展现了AI产业化落地的成功模式。

量子位
推荐文章7

相信模型成本会下降,才是业内最的幻觉

很多AI创业者认为模型降价能降成本、改善营收。但文章指出,成本下降仅针对老旧模型,最好模型成本致相同,且模型token消耗激增。还探讨了AI创业商业模式,如按使用量计费、建立高切换成本、垂直整合等。

Founder Park
推荐文章8

忘记模型,英伟达:小模型才是Agentic AI的未来!

截至2024年末,Agentic AI领域获超20亿美元初创公司融资。NVIDIA研究报告显示,多数Agentic AI场景中,小型语言模型已足够强、更适配、更便宜,LLM-to-SLM迁移是必然趋势。

PaperAgent
产品应用8

百度造了个“AI星舰”?或成业界最完备的企业级AI平台

在2025百度云智会上,百度智能云千帆企业级AI开发平台发布4.0新版本,核心聚焦Agent。它一站式提供开发所需能力,解决模型选型、数据盘活等难题,还有RFT工具链降精调门槛,“白盒化”助问题诊断。

InfoQ
算法论文8

上下文记忆力媲美Genie3,且问世更早:港和可灵提出场景一致的交互式视频世界模型

交互式长视频生成缺乏稳定场景记忆,制约下游应用落地。Google DeepMind的Genie 3有强场景一致性但未公开技术细节。港和可灵提出的Context as Memory模型,上下文记忆力媲美Genie 3且投稿更早,还提升了计算效率。

机器之心
开源动态8

Qwen-Scope:看穿模型的“小心思”

Qwen-Scope是基于Qwen3和Qwen3.5系列模型训练的可解释性模块,通过在隐藏层插入SAE提取可解释特征。它能分析模型行为、优化模型,应用于推理、数据、训练、评估等场景,可前往Huggingface或魔搭体验。

千问大模型
新闻资讯8

让AI学会潜意识推理,Sapient发布类脑模型HRM

新加坡初创公司Sapient Intelligence发布仅2700万参数的分层推理模型HRM,在多项高难度推理任务上超越模型。它绕过模型推理困境,借鉴脑机制,训练效率高,开源后GitHub星标突破10.3k。

AIGC开放社区