代码执行模式」共找到 2857 篇相关文章

推荐文章7

Token成本下降,订阅费却飞涨,AI公司怎么了?

文章指出,虽模型训练成本下降,但 AI 公司运营成本尤其是推理费用猛增。以固定费率订阅和高 token 消耗的商业模式的公司面临困境,如 Windsurf、Claude Code 等,还给出避免亏损的三条出路。

机器之心
新闻资讯7

Claude 小升级就赢了OpenAI 9年“开源神作”?高强度推理直接歇菜、幻觉率高达50%,写作还被Kimi 2吊锤?

OpenAI发布首个开源语言模型系列gpt - oss,包括gpt - oss - 120b和gpt - oss - 20b,可在Hugging Face下载。同期谷歌Deepmind推Genie 3,Anthropic放出Claude Opus 4.1。Claude Opus 4.1编程性能提升,实测编码能力强于gpt - oss。gpt - oss虽有亮点,但幻觉率高、实测效果不佳。

AI前线
推荐文章7

AI 产品定价指南

本文编译对按量计费平台初创公司 CEO Scott Woody 的访谈,探讨 AI 改变软件定价逻辑、不同类型 AI 公司应对之法,还补充定价专家 Madhavan Ramanujam 关于 AI 产品定价四象限观点。

海外独角兽
开源动态8

阿里再开源,全球首个MoE视频生成模型登场,电影级美学效果一触即达

继上周开源三连发后,阿里昨晚开源全球首个 MoE 架构视频生成模型 Wan2.2,具电影级美学控制能力。它有 MoE 架构创新等四大技术亮点,可在 Hugging Face 和阿里魔搭社区下载。

机器之心
算法论文8

训练数据爆减至1/1200!清华&生数发布国产视频具身基座模型,高效泛化复杂物理操作达SOTA水平

清华大学与生数科技联合研发Vidar模型,首次让通用视频大模型长出‘手脚’,实现从虚拟到真实世界物理执行的跨越。它降低数据门槛,突破跨本体泛化困境,为服务机器人应用奠定基础。

量子位
开源动态7

Distilabel DeepSeek-R1 模型蒸馏教程

文章介绍结合distilabel与QLoRA技术定制专属大模型的路径。先用distilabel框架利用DeepSeek - R1生成医疗指令数据集,再用QLoRA技术微调Qwen3 - 4B模型,还给出实战路线图和代码示例。

机器学习AI算法工程
新闻资讯7

MiniMax 技术闭门会分享:长上下文是 Agent 的 Game Changer

MiniMax 7月10日举办M1技术研讨会,探讨模型架构创新等领域。会议围绕RL能否赋予模型新能力、预训练价值等展开,指出长上下文是Agent的Game changer,混合架构将成主流,还分享了混合架构推理实践及M1相关问答。

Founder Park
开源动态7

数千大模型全跑「中国芯」!最后一公里已「焊」通

国产芯片运行大模型需额外适配,魔乐社区以开源模型推理适配协作模式破局。它推出‘模型推理适配协作计划’,联合多方力量,打通国产算力与大模型应用‘最后一公里’,还举办赛事激发创新活力。

新智元
新闻资讯7

网友:马斯克杀死了人类出生率

Grok推出带二次元虚拟形象的AI伴侣功能,引发网友热议。技术问题修复后,外观、道德等方面遭质疑。一直呼吁提高生育率的马斯克推出此功能,被指是“生育率杀手”,但也有人认为其或提高出生率。

AGI Hunt
新闻资讯7

专访AI.Talk赵汗青 - 我不是一个创作者。

文章专访AI.Talk赵汗青,探讨AI虚拟IP YURI爆火背后的故事。赵汗青以构建虚拟人格为目标,借AI.Talk探索,让YURI多领域发展。他还谈到IP构建、商业模式及运营思路等,强调做有溢价之事。

数字生命卡兹克