「ERNIE-4.5-0.3B」共找到 4871 篇相关文章
离开Meta后,田渊栋刚刚官宣创业了
离开Meta后,田渊栋参与创立Recursive_SI。该初创公司致力于打造可自主实验、自我改进的AI,已筹集6.5亿美元,估值46.5亿美元。团队成员经验丰富,在递归自我改进方向有深厚学术积累。
上周 GPT 和 Codex 各有一个发布,很多人没注意吗?可以解锁 Codex 百万上下文了
最近基模发布多,OpenAI 俩更新被低估忽略。一是 GPT - 5.6 Sol 的 Ultrafast 模式,输出最高达每秒 750 Token,先向少量 API 客户开放;二是 Codex 为其开放百万上下文能力,不过大窗口有代价。
12ms!一个仅8M的语音停顿检测模型
语音助手准确判断用户是否说完是挑战,Smart Turn将决策过程缩至12毫秒。其v3.1版有改进,新增数据集提升英语识别准确率,推出未量化版本推理更快,8MB模型性能优,已在HuggingFace开源。
The Batch: 977 | AI 对速度的需求为何如此迫切
开发者如今需更关注AI速度。OpenAI和Cerebras的Ultrafast、Google的Gemini 3.7 Flash、Nvidia的Nemotron 3.5 Lightning都主打速度。速度在AI领域对应延迟和吞吐量,影响应用体验和范围。
开源模型终于有了自己的 Opus 时刻
智谱深夜发布的新一代旗舰模型 GLM - 5,此前以匿名模型 Pony Alpha 被开发者热测。2026 年编程大模型风向转变,GLM - 5 参数提升,测试成绩优异,实测能完成复杂工程任务,适配国产算力平台。
AI遭遇灵魂拷问!这道题所有模型集体翻车,网友:我也不会啊
图像推理现新难题,在Reddit引发热议,目前无AI能真正解决。国内外支持图像输入的大模型答案不同,原因是对大立方体规格理解不同。结合提示多次尝试,部分大模型能找准方向,人类面对该问题也会困惑。
DeepSeek陈德里开发自动研究Skill,写一篇论文人类只动脑2小时
DeepSeek研究员陈德里用自己开发的技能DeliAutoResearch等完成研究综述论文。论文提出自动研究智能体L1–L5自主度分类体系,对比四大架构模式,分析17个主流系统,还提出六大开放问题。
Meta归来!时隔一年发布Muse Spark,重回第一梯队
Meta发布Muse Spark模型,这是MSL团队首款模型。此前Llama 4表现不佳,刺激Meta重组。Muse Spark性能超Llama 4,计算效率提升,在测试中成绩优异,Meta AI战略转向闭源探索,模型已上线。
刚刚,OpenAI在ICPC 2025编程赛上满分登顶,Gemini也达到金牌水平
在ICPC 2025编程赛上,OpenAI 5小时内解决12个问题满分登顶,其由通用推理模型集成体构成,结合GPT - 5与实验性模型;Gemini解决10个问题达金牌水平,在部分难题表现出色。
chardet 从 LGPL 变 MIT:一场 AI 重写引发的开源风波
Python 编码检测库 `chardet` 发布 `7.0.0` 后,许可证从 `LGPL` 变为 `MIT`,维护者称借助 Claude Code 重写。原作者反对,认为维护者无权重新授权。维护者给出辩护,社区反应激烈,争论涉及多个法律问题和不同立场。