私有发电厂」共找到 521 篇相关文章

新闻资讯7

DeepSeek-V3.2被找出bug了:疯狂消耗token,答案还可能出错,研究人员:GRPO老问题没解决

DeepSeek-V3.2虽强且火爆,但被现存在bug,即浪费token问题。研究者指出这源于GRPO算法的‘隐藏偏见’,虽修正了‘难度偏见’,但‘长度偏见’仍在,官方也承认token效率是挑战。

量子位
新闻资讯7

停工停薪,百亿智驾独角兽停摆了

据红星资本局消息,2025年11月22日毫末智行停工通知,自24日起员工停工放假,复工时间待定。该司曾是资本宠儿,如今账户冻结、工资停。其衰落因技术掉队、商业化不顺等,凸显行业淘汰赛残酷。

芯师爷
7

一句话启动AI打工人?我用Claude Skills做了个“微博热搜挖掘机”,效率炸了!

作者黄叔分享用Claude Skills做“微博热搜挖掘机”,介绍其类似给AI员工《员工手册》,还讲了准备工作,如获取微博热搜接口,输入指令后Claude自动干活,成果可观,Claude Skills适合普通人入门。

AI产品黄叔
开源动态8

Kimi K2 Thinking突袭!智能体&推理能力超GPT-5,网友:再次缩小开源闭源差距

Kimi K2 Thinking布并开源,主打“模型即Agent”,能边思考边用工具,连续工具调用200 - 300次。在多评测基准超GPT - 5等闭源模型,代码权重遵循MIT协议,可在官网和应用实测。

量子位
新闻资讯7

Meta 演示现场翻车的原因……让人好笑又心疼

Meta Connect大会上Meta Reality Labs演示翻车,原因是语音命令激活多人Meta AI,对开服务器DDOS攻击,且MPK所有人被路由到该服务器,此外眼镜显示屏还有意外bug,这次翻车为行业提供了经验。

AGI Hunt
算法论文8

DPad: 扩散大语言模型的中庸之道,杜克大学陈怡然团队免训推理加速61倍

扩散大语言模型(dLLMs)有全局规划能力,但存在计算冗余。杜克大学陈怡然团队揭示其“草稿纸机制”,提出免训练方法DPad,结合现有技术,能在几乎无损精度下实现高达61.4倍推理加速。

机器之心
7

GPT-4o替代爹味GPT-5!奥特曼光速滑跪,OpenAI连夜回滚「赛博舔狗」

GPT-5上线后因冷漠爹味遭用户抵制,奥特曼宣布GPT-4o满血复活成默认模型,还让GPT-5更具个性。同时揭示用户与模型的情感联系,也指出GPT-5对开者意义重大。

新智元
新闻资讯7

LLM总是把简单任务复杂化,Karpathy无语:有些任务无需那么多思考

随着推理大模型和思维链普及,大模型有了‘深度思考’能力,但现在有些偏科,简单任务也复杂化。AI大牛Andrej Karpathy长文指出该现象,认为是基准测试优化所致,大模型展不能只追求分数。

机器之心
新闻资讯8

黄仁勋:每天都在用AI,提示工程可以提高认知水平

黄仁勋在CNN访谈称每天用AI,认为提示工程是高级认知技能,AI会重塑工作非消灭岗位,还提及中国市场重要性,宣布H20获批入华、将新显卡RTX Pro,不过其他专家看法不一。

量子位
新闻资讯7

亿点点新融资砸向具身智能:斯坦福华人团队,首创“自适应机器人”品类

具身智能火热,非夕科技完成C轮亿级美元融资,由咏归基金、广信德联合领投。该公司由斯坦福大学相关成员创立,首创“自适应机器人”品类,此轮资金用于扩产、研及生态拓展。

量子位