「AI 模型构建」共找到 13747 篇相关文章
担心蒸馏问题,Meta限用Claude Code、Codex
据外媒报道,Meta限制员工在AI模型构建中用Claude Code和Codex,因担心涉及模型蒸馏,且随着AI使用成本上升,Meta想让更多开发工作迁至MetaCode,这揭开了AI Coding时代新问题。
陈天桥重磅出手!20瓦人脑秘籍,AI大模型瞬间「破防」
上周六,天桥脑科学研究院创始人雒芊芊宣布成立尖峰智能实验室,由李国齐教授领衔,致力于类脑大模型和脉冲神经网络研发。该实验室是‘发现式智能’理念落地载体,将借鉴人脑特性研发类脑大模型。
合合信息:基于 JuiceFS 构建统一存储,支撑 PB 级 AI 训练
合合信息为应对AI训练存储挑战,引入JuiceFS构建统一存储架构,结合BeeGFS作缓存。该架构提升I/O性能与资源调度效率,还通过缓存优化、数据治理等措施,支撑多业务并发,为AI基建奠基。
个体如何实现主权AI
文章指出越依赖AI,越要考虑‘主权AI’问题。对个体而言,实现主权AI核心是掌握自身数据等,能随时换底层模型,还介绍积累的四类资产、微调顺序及现实路径。
创智&交大发现AI能动性新规律, 78样本胜GPT5实现软件+科研自动化
上海创智学院和上海交大刘鹏飞老师团队发现AI能动性新规律,LIMI仅用78个样本就超越GPT - 5达14.1%,提出能动性效率原则,即AI能动性不仅源于数据丰富性,更来自战略性构建,为AI系统开发开辟新路径。
社区供稿丨35B参数科学性能比肩万亿参数模型,『书生』科学大模型Intern-S2-Preview开源
5月15日,上海AI实验室开源新一代大模型预览版Intern - S2 - Preview,参数35B,多领域比肩万亿参数模型。它深化与昇腾算力生态协同,探索‘通专融合’,强化科学及智能体能力,‘算法 - 系统 - 算力’协同提升训推效率。
Zed 为什么不用自己造 Agent?OpenAI 架构师给出答案:Codex 重划 IDE × Coding Agent 的分工边界
Coding agents 是应用型 AI 活跃领域,但团队常重复构建脆弱基础设施。OpenAI 的 Codex 提出“模型和 Harness 共同构建”,架构师介绍构建挑战与使用模式,还阐述了将模型适配到 Harness 的问题及未来发展方向。
Anthropic 哲学家首次 AMA:关于 AI 哲学与伦理边界
Anthropic的哲学家Amanda Askell在首次AMA中,就AI哲学与伦理边界等诸多问题作答,涉及AI道德决策、模型特点、理论与实践、模型福祉等内容,还谈及对各类问题的看法及解决思路。
100亿美元!AI时代最闷声发财的两家公司,要合并了
《华尔街日报》报道,支付公司Stripe正与AI初创公司OpenRouter谈判收购事宜,价格达100亿美元。OpenRouter是全球规模最大的AI模型聚合平台,Stripe为科技公司提供底层金融服务。此次收购将扩展Stripe业务至AI生态。
英伟达韩松团队新作:具有后神经架构搜索的高效语言模型
英伟达韩松团队推出基于后神经架构搜索的高效语言模型Jet - Nemotron,在基准测试中表现出色,准确率与Qwen3等相当甚至更优,生成吞吐量大幅加速。模型构建经多步骤优化,代码和预训练模型将开源。