工程体系」共找到 1273 篇相关文章

新闻资讯8

Anthropic首次揭秘下一代Claude怎么造!用户吐槽直接喂模型,连AI“做梦”都被训练

Anthropic研究团队产品经理Alex在访谈中透露Claude演进方向,如将模型开发产品化、向“持续运行Agent”演化,还解释“dreaming”机制等,也提及训练“人格”、研究意识等,展现了长远思考。

InfoQ
新闻资讯7

罗福莉:Claude订阅封杀龙虾背后,真正的出路不是更便宜的token

Anthropic宣布Claude Pro和Max订阅用户不得将额度用于第三方Agent框架,引发各方反应。Xiaomi MiMo大模型负责人罗福莉指出,当前token计费模式难应对挑战,需更优算力使用方式,还介绍了小米MiMo Token Plan。

机器之心
新闻资讯8

马斯克刚刚官宣了“芯片美国梦”

美国当地时间3月21日,马斯克联合SpaceX、Tesla、xAI发布TERAFAB项目,启动超大规模芯片制造设施,目标年产1太瓦计算能力,80%产能服务太空任务,虽面临诸多挑战,但意义深远。

芯师爷
推荐文章7

对话 AI异类弗兰克:我聘请了一位「龙虾CEO」

本文是对AI圈的Frank的访谈,他运营公众号“AI异类弗兰克”,投身“QLab”项目。他认为AI agent是超体,QLab以agent“Q”为核心,打破岗位边界,跑通商业化,未来agent将成超体重构供需。

AI科技评论
开源动态8

12小时登顶OpenAI MLE-bench!上海AI Lab开源算法进化框架MLEvolve

上海AI实验室开源算法进化框架MLEvolve,12小时登顶OpenAI MLE - bench榜单第一。它是自进化机器学习系统,在75道Kaggle竞赛题上奖牌率达61.33%,为AI自主算法设计提供新方案。

量子位
开源动态8

多模态Deep Research,终于有了「可核验」的评测标准

俄亥俄州立大学与 Amazon Science 等联合发布 MMDR - Bench,将多模态 Deep Research 评估拉到可核验标准。它含 140 个专家任务,覆盖 19 领域,把评估拆成 3 段管线、12 指标,强调过程证据链。

机器之心
产品应用8

可灵3.0系列模型正式上线:属于每个人的导演时代来临

可灵AI正式全球上线3.0系列模型,覆盖影视级全流程链路。该系列基于All-in-One理念构建,解决了行业一致性等问题,在多方面做了增强,完成从单点生成到专业调度的跃迁,让AI成创作协作者。

AI科技评论
推荐文章8

AI 编程 2025 总结:国产模型“能力追平”,国产编程工具还在“情感陪伴”

文章总结2025年AI编程发展,指出国产编程模型能力追平、工具与模型开放集成等六大趋势,同时提到AI替代重复劳动、提升核心能力门槛,呼吁2026年关注工程确定性。

phodal
推荐文章7

Karpathy:别再问AI「你怎么看了」,这是错误的提示词策略!

Andrej Karpathy提出不要把大语言模型看作实体,应视作模拟器。他建议探索话题时避免用‘你怎么看’提问,给出‘什么样的一群人适合探索,他们会怎么说’的更优策略,还指出不同领域影响有别。

AI寒武纪
算法论文8

小模型才是 Agent 的未来?这篇立场文把话挑明了

AI Agent浪潮来袭,主流用LLM构建,但英伟达和佐治亚理工学院研究人员论文指出,多数Agent场景中,小语言模型(SLM)已足够强、更好管、更省钱,还给出迁移清单、避坑建议和参考系统形态。

AI寒武纪