「Grok Code Fast 1」共找到 2718 篇相关文章
LLM的RL训练轨迹竟然是线性的?Miaow Lab|新工作:无需继续训练,直接“预测”未来模型!
文章介绍《Not All Steps are Informative: On the Linearity of LLMs' RLVR Training》,揭示RLVR训练中LLM权重和输出概率线性变化,提出“权重外推”法,可实现6.1倍训练加速,还介绍三种策略及实验结果。
5行代码,逼疯整个硅谷!澳洲放羊大叔,捅开AI编程奇点
澳大利亚养羊大叔Geoffrey Huntley的5行代码Ralph-Wiggum循环震动硅谷。它让Claude Code和Cowork发展,开发者用其屡创佳绩。该技术强调失败价值,虽有局限,但预示软件开发行业深层转型。
ChatGPT「群聊」功能正式开启内测
OpenAI正式在部分地区试点ChatGPT群聊,覆盖移动端和网页端。该功能可用于生活娱乐、工作学习等场景,由GPT - 5.1 Auto模型驱动,操作简单,还考虑了隐私与控制。
豆包也开始抢程序员饭碗了,首个编程模型来了!
字节给豆包升级编程能力,推出首款编程模型Doubao - Seed - Code。它刷新国内编程模型上下文长度,支持视觉理解,API价格良心。经测试,虽未达全球顶尖,但弥补国产编程模型短板。
AI“压力面”,DeepSeek性能暴跌近30% | 清华&上海AI Lab
上海人工智能实验室等团队设计REST框架,在一个prompt里抛多问题模拟复杂推理场景。结果显示,DeepSeek - R1等模型高压下性能大幅缩水,REST能拉开不同模型差距,还揭示评测方法局限。
知名产品工程师开源「一整套编程skill」,每个人都能有顶级的工程习惯
现在用AI写代码存在效率低、浪费token等问题,知名开发者tw93发起开源AI编程skill库Waza,将顶尖工程师习惯转化为Claude Code可运行技能,推出8实用技能,还提供两个小脚本。
Harness Engineering 时代的失败经验
作者分享在Harness Engineering时代使用Coding Agent的经验,指出虽Agent发展快且有成功案例,但实际应用有诸多问题,如部分模型体验差、自然语言模糊影响长程工作等,还给出解决思路,文章会持续更新。
新榜单CompileBench:让AI能搞定22年前的老代码
近日,CompileBench 测试 19 个 AI 模型编译真实代码能力,最难任务是复活 2003 年代码并交叉编译到 Windows 和 ARM64。不同模型表现不同,如 Claude Opus 4.1 成功完成 ARM64 静态编译,各模型有不同优缺点。
全流程国产GPU,上下文提速100倍!中国科学院发布「线性复杂度」类脑大模型
中国科学院自动化所李国齐、徐波团队发布国产自主可控类脑脉冲大模型SpikingBrain-1.0,训练推理全用国产GPU。它具线性复杂度,超长序列处理速度快,还开源7B模型,为类脑智能发展提供新思路。
AI生图大洗牌!流匹配架构颠覆传统,一个模型同时接受文本和图像输入
AI生图有新突破,新模型FLUX.1 Kontext用流匹配架构,与此前技术不同,能接受文本和图像输入。其来自Black Forest Labs,有编辑和生成能力,还具备4个特性,第三方测试也给出提示词使用技巧。