「善意的混乱」共找到 10474 篇相关文章
Transformer上限触顶,Mobius能否引发下一代模型架构的革命?
自ChatGPT问世,Transformer上限备受关注。前OpenAI、Google负责人称其走到尽头。国内改进架构受算力限制。上海人工智能实验室的书生Mobius团队提出分离知识与推理的架构,有望解决商用等关键问题。
鹅厂员工那些“需求很大,却没人做”的小程序?
鹅厂员工分享了多个需求大却没人做的小程序idea,如“鹅众点评”、展示商场餐厅实时人流量的小程序、老年人“极简版”工具小程序等,涵盖生活、出行、旅游、育儿等多方面。
“这半年,我也用AI救了6条活生生的命啊。”
本文讲述作者用AI对抗癌症的经历,介绍阿里达摩院发布的胃癌早筛模型GRAPE和胰腺癌早筛模型PANDA。作者亲身体验PANDA筛查流程,医生业余投入项目,半年额外发现6个早期患者,令人感动。
Science重磅:AI编程新手与资深开发者之间的差距巨大
《科学》杂志发表的AI编程全球调查研究显示,美国程序员提交的Python代码中29%由AI代笔,资深开发者借此拉大与新手差距。研究团队用GraphCodeBert模型分类器扫描代码,揭示技术扩散差异与隐忧。
「看」能否取代「读」,为何DeepSeek-OCR 爆火的重点不在性能?
DeepSeek近期开源的DeepSeek - OCR在AI社区引发热议。它提出‘上下文光学压缩’理念,以视觉方式压缩文本。社区关注重点在其研究思路对NTP范式的影响,有望解决长上下文经济性难题等。
硅谷的企业级AI正在这样赚钱|2025人工智能现状报告
ICONIQ Capital发布的2025年人工智能现状报告聚焦企业级AI变现。报告基于对300名软件公司高管的调查,分析了模型选择、支出、工具使用等情况,指出AI产品战略进入新阶段,定价策略在重塑等。
从性能到实战,怎样才算是靠谱的 Agent 产品?
红杉中国团队提出AI基准测试工具Xbench,其双轨测评体系不再单纯执着于测评问题难度,重点量化AI系统在真实场景的效用价值,还构建长青评估机制,以确保评估结果的时效性和相关性。
全球首次实测通过!CMU华人用AI设计的乐高「不翻车」
CMU研究人员提出LegoGPT,它微调Meta的LLaMA模型,结合47000个稳定结构数据集,确保98.8%的乐高设计符合物理定律,可实际搭建。目前,数据集、代码和模型均已开源。
Qoder Skills 完全指南:从零开始,让 AI 按你的标准执行
文章介绍Qoder Skills,它是强大AI定制方式,像菜谱让AI按标准执行。阐述本质、结构、原理,对比与其他工具差异,说明适用场景、安装方法,还有实战演示、编写规范、测试迭代及团队协作等内容。
《动手写AI Agent》50 行代码,你的第一个 Agent
文章教你用50行代码打造能读文件、跑命令、自主决策的AI Agent Ling。介绍用JSON Schema给LLM装工具,通过循环让LLM按需调用工具,还给出运行示例及与Claude Code的对照。