少即是多」共找到 5178 篇相关文章

产品应用7

Kimi K2:唯一能稳定准确生成时钟的AI模型

AI World Clocks项目让9个大模型按提示词生成每分钟更新的时钟,以观察稳定性。国产Kimi K2唯一能稳定保持表盘与指针正确平滑转动的模型,测试显示了模型在时空概念上的能力差异。

AI工程化
算法论文7

刚刚,OpenAI前CTO:战胜LLM不确定性的方法找到了!

OpenAI前CTO创立的Thinking Machines Lab发布研究《战胜LLM推理中的不确定性》。研究指出LLM推理不确定性主因批处理大小变化,而非常见认为的GPU并行性等。还给出实现批处理不变性的方案及实验结果。

PaperAgent
新闻资讯8

Karpathy最新开喷:一句话让全场Agent开发者安静了

Andrej Karpathy在面向Agent开发者的分享中称,当前AI最大错误急着逼Agent干活,没先搞明白底层大模型。他结合自身经历给出三步忠告,还建议从神经科学找灵感,鼓励开发者。

新智元
新闻资讯7

突发!卡帕西官宣加入Anthropic,OpenAI对家挤满了前员工

安德烈·卡帕西宣布加入 Anthropic,负责 Claude 模型大规模训练。他知名 AI 研究者,曾任职 OpenAI、特斯拉等。此前 AI 人才争夺 Meta 和 OpenAI 主角,Anthropic 闷声吸纳了卡帕西,OpenAI 联合创始团队成员多有流失。

DeepTech深科技
新闻资讯7

GPT-5系列咋都爱说「哥布林」?原因找到了

OpenAI发布博客解释模型迷上「哥布林」的原因。原来训练“Nerdy”人格时,奖励信号偏爱怪物词汇,强化学习将风格固化并扩散到普通对话。此前DeepSeek V3.1也出现过「极」字Bug。

机器之心
开源动态7

DeepSeek悄悄更新:Mega MoE、FP4 Indexer来了

昨天下午,DeepSeek 更新了 DeepGEMM 代码库,带来新东西 Mega MoE。它将 MoE 计算流程整合,让数据通信和计算同时发生,提高 GPU 利用率。还尝试组合精度、搞 FP4 indexer 等,基础设施层重构尝试。

机器之心
7

卖鞋厂转型做 AI 股价暴涨 582%,华尔街最不缺这种荒诞闹剧

4月初还在发布新品的鞋履品牌Allbirds,一周后宣布将业务重心转向人工智能计算基础设施。消息公布后,其股价一天内涨幅超582%。这种转型并非首例,背后资本市场对热门概念的追逐。

AI前线
7

我花499找人上门安装OpenClaw,看到了AI时代最魔幻的一幕。

作者花499元体验OpenClaw上门安装服务,发现市场价格混乱,从30到5000元不等。安装师傅非技术出身且自己用该工具。同时指出OpenClaw有安全隐患,提醒大家别因恐惧盲目安装。

数字生命卡兹克
新闻资讯7

美国AI一骑绝尘,中国平均落后7个月!Epoch AI新报告出炉

Epoch AI报告指出,中国AI模型进展平均落后美国7个月,最小4个月,最大14个月。这差距本质「开源vs闭源」差距,中国领先大模型多开源,美国前沿模型均闭源。不过中国AI追赶速度稳定。

新智元
开源动态8

Karpathy再放大招:8000行代码复现ChatGPT全栈,最低成本仅100美元,4小时跑完

Andrej Karpathy发布项目nanochat,全栈式ChatGPT克隆体训练/推理流水线,代码约8000行,覆盖训练分词器、预训练等完整流程。介绍不同成本下模型表现,还回答网友关于架构、训练数据等问题。

AI寒武纪