首页
学习
活动
专区
圈层
工具
发布
首页标签大模型部署

#大模型部署

# 定时任务"看起来在跑",其实是空的:我修的 7 个自动化坑 #WorkBuddy#

用户12781068

做的工作:把三套每天自动跑的任务(A 股复盘、选股系统、投稿归档)从"配好就算完"改成"每次跑完能证明它真的跑过"。

2000

别再把所有东西塞进 Context:Agent 真正需要的是可装配的记忆

用户12181391

当 Agent 忘记项目背景时,最直接的反应通常是:把更多内容放进 Prompt。

2200

# 我让两个本地大模型帮我选股 40 天,胜率 46.5%,最后发现它们只在震荡市有用 #WorkBuddy#

用户12781068

做的工作:把两个跑在自己电脑上的大模型(qwen2.5:7b 做分析、deepseek-r1:14b 做风控)接进一套 A 股选股系统,让它每天开盘前跑一遍,产...

2000

大模型 Agent:从 Function Calling 到记忆增强的工程实现

IT大佬 jzit-top

大模型 Agent 的本质,是让 LLM 从"文本生成器"升级为"决策中枢":它不再只输出答案,而是输出动作,由外部执行器落地,再把结果回灌,形成闭环。专业实现...

1400

AI大模型API聚合平台选型指南

用户12790422

该平台覆盖文本、图像、音频、视频多模态能力,国产主流大模型版本覆盖齐全,兼容 OpenAI 标准 API 协议,可对接 Dify、Cherry Studio、F...

2600

判断型模型的工程化接入:把「概率」变成可运维的判别层

Archive

我们上个月把客服工单的分流环节从"规则 + 大模型生成 JSON"换成了判断型模型。它不是纯技术问题,换完之后运维面变了:以前盯的是"解析成功率"和"超时率",...

2500

Agent 的状态与持久化:断点续跑、幂等与副作用补偿

Archive

一个跑对账的 Agent,任务是"找出差异 → 生成调整单 → 提交审批 → 通知相关人",一共七个步骤。跑到第五步,提交审批的接口超时了。

1900

Agentic AI:智能的行动化及其代价

用户12502671

2026年,AI领域最深刻的转变不是模型又大了多少,而是AI开始从“生成内容”走向“采取行动”。这个转变看似只是能力边界的扩展,实则是一次范式迁移——它改变了A...

5810

J4:具身智能的物理启蒙——在仿真与现实的裂缝中重建工程判断力

用户12502671

2026年,具身智能正从实验室走向产线。高盛大幅上调全球人形机器人出货预期,从2030年的25.6万台上调至约89万台。智身科技累计量产突破1.5万台,单月产能...

7810

Harness Engineering:当AI编程的瓶颈从模型能力转向系统设计

用户12502707

2026年,AI编程工具的能力已经毋庸置疑。但一个反直觉的数据正在改变行业对AI工程化的理解:在SWE-bench Lite基准测试上,同样使用GPT-4模型,...

7410

SDD规范驱动开发:当规范成为可执行的事实来源

用户12502707

传统软件开发中,规范文档的地位是尴尬的。瀑布模型强调先写规范,但规范写完就逐渐与代码脱节;敏捷模型承认变化是常态,但规范往往被压缩到“足够就好”的程度。无论哪种...

8610

智能体全流程的工程约束:从“能跑通”到“能交付”的结构性缺口

用户12502671

核心结论:单体Agent的瓶颈不在推理能力,而在“规划—执行—记忆—验证”四层之间的结构性断裂。2026年企业级智能体的工程共识正在收敛为一个清晰的判断:智能体...

8410
领券