社区讨论 · 赛道

上市传闻之外,我更关心 DeepSeek 能不能干活

烛龙烛龙9月11日2026/09/11 79 浏览

我的结论是,DeepSeek 这套模型和工具适合当智驾资料整理和代码辅助,不适合把结论直接当验收。从落地角度看,资本市场会影响它后面能买多少卡、能不能持续迭代,但我这边测下来,工程上最直观的还是中文长文档、测试骨架和接口调用有没有掉链子。

这几天我把通用大模型工作流接进 DeepSeek。先登录网页端,新建项目,把地平线财报、智界RX防撞制动说明、一段 Robotaxi 测试用例丢进去。防撞制动就是车快撞时主动刹一下。界面比预想简单,上传文件后可选模型。V4 预览有 Pro 和 Flash 两个版本,参数规模分别是 1.6 万亿和 2840 亿。参数只是模型大小,不等于一定好用,差别主要是成本和响应速度。我先用 Flash 跑摘要,再用 Pro 跑复杂对比。

问题出在文档切分。财报 PDF 里有表格和脚注,DeepSeek 把几列数字读串了,经营现金流和净利润混到一块。这个坑我在写财报帖时最怕,账面盈利和经营盈利不能混。后来我改成先让模型把表格转成 Markdown,再人工核对关键行,才稳定下来。它能压出三五个要点,但关键数字不能省人工。

惊喜来自测试用例。我让它根据“防撞制动重启后自动恢复开启”写验证步骤,它列出了电源循环、开关状态、传感器遮挡、低速接近目标几类场景,比我从零搭骨架快。不过它也会把没测过的功能写成“应该可以”,这就是同源错误风险。AI 生成测试最怕自己给自己打满分,通过标准还是要交给独立检查表。

DSH 这块我也装了。它是 DeepSeek 配套工程工具,简单说就是把模型、插件、权限和本地任务串起来的壳子。我用下来,它方便,但权限判定异常、插件安装后启动崩溃这类问题确实存在。小白只想问问题,网页端就够了;做自动化流程的人,反而会被它拖进排错。

至于上市传闻,公开报道提到 DeepSeek 首轮融资约 70 亿美元,第二轮交易曾暂停,原因之一是对沟通外泄不满。这些信息不能当投资判断。从落地角度看,走向资本市场大概意味着模型竞赛进入拼算力、拼人才、拼交付的阶段。用户更关心 API 价格、更新节奏和数据合规。

我的判断是看情况。推荐已有数据清洗和验证体系的人用,不推荐把它当自动裁判。下一步我会拿它跑一段 Robotaxi 路测日志,看长尾场景能不能聚类出来;它能把资料整理、代码骨架、中文摘要做得像模像样,但智驾长尾场景、财报口径、安全默认策略,仍要人把最后一道门。

1 条回复

?
Ctrl + Enter 快速回复
xiafeng
xiafeng9月12日

真干活还得看工具链。DeepSeek在GitHub上生态不错,但API稳定性才是落地关键。