智谱专家交流要点-20260708
算力采购情况:智谱2026年算力整体算力预计订单规模在200亿左右,2027年预计会签300-400亿。目前公司签长单框架协议的有三家,行云科技约55亿,协创数据约40亿,宏景科技30亿。公司A股上市后还会有资金去进一步支撑采购的扩张。
租赁成本与交付:8卡H200月租10–12万(市场直租14万),8卡B300长单约18万,目前公司争取把H200长单压到8–10万左右。交付端:B300行云已交付、宏景下半年到货,现阶段高性能卡供应整体偏紧。
盈利与增长情况:当前公司毛利率约40%,目标2026年底提至50–60%,靠专家模型/长上下文优化+单位算力token产出提升20–30%+增加高端算力实现毛利的提升。单台8卡B300月售token净收入约100万;国产卡毛利仅20–30%,性能部分不及A100。
收入端环比增速约30%,ARR目标10亿美金已达成40–45亿人民币,4月单月API收入4–5亿,算力充足下年底单月可达7–8亿,核心瓶颈是算力不足,高端卡盈利性较好,租高端卡的意愿强。
Token分成情况:2026年6月新提出:合作方自担服务器成本、无固定租金,按token产出分成——单台B300按七折分佣月收入约60万,投入比较大,目前还没有落地的合作伙伴。
#未知信源
来自频道: @DNSPODT
DeepSeek V4即将发布:端到端生成可运行游戏,灰度测试启动
DeepSeek此前公告称将于7月中旬(10日至20日区间)推出DeepSeek V4正式版,目前该版本疑似处于灰度测试阶段。
有用户发布相关测试视频,对DeepSeek V4正式版的生成游戏能力进行测试,分别两次生成《我的世界》、一次生成《CSGO》,生成的游戏完成度较高,其中CSGO游戏生成仅花费9毛钱。
现有V4预览版不具备一次性生成游戏的能力,AI编程能力有限,V4正式版相比预览版有大幅性能提升,后续预计会有更多用户收到灰度测试推送,出现更多测试结果。
来源:BiliBili@冬眠の松鼠_
DeepSeek此前公告称将于7月中旬(10日至20日区间)推出DeepSeek V4正式版,目前该版本疑似处于灰度测试阶段。
有用户发布相关测试视频,对DeepSeek V4正式版的生成游戏能力进行测试,分别两次生成《我的世界》、一次生成《CSGO》,生成的游戏完成度较高,其中CSGO游戏生成仅花费9毛钱。
现有V4预览版不具备一次性生成游戏的能力,AI编程能力有限,V4正式版相比预览版有大幅性能提升,后续预计会有更多用户收到灰度测试推送,出现更多测试结果。
来源:BiliBili@冬眠の松鼠_
来自频道: @DNSPODT
Reuters
中国正考虑限制海外获取本国顶尖人工智能模型,消息人士称。
消息人士称,阿里巴巴、字节跳动和智谱AI参加了与当局的会议。
消息人士表示,官员们暗示人工智能泄密或盗窃可能被纳入国家安全法处罚范围。
中国正考虑限制海外获取本国顶尖人工智能模型,消息人士称。
消息人士称,阿里巴巴、字节跳动和智谱AI参加了与当局的会议。
消息人士表示,官员们暗示人工智能泄密或盗窃可能被纳入国家安全法处罚范围。
来自频道: @DNSPODT
【熟肉/转载】语言模型中的全局工作空间|Anthropic
https://www.youtube.com/watch?v=rKV5JcALQoQ
在你大脑此刻发生的所有事情中,只有极小一部分是有意识可及的——即你能够描述、记在心里并进行推理的想法。我们在我们的 AI 模型 Claude 中发现了惊人相似的划分。
我们的实验受到神经科学领域一个前沿理论的启发:全局工作空间理论。该理论认为,当一个想法进入一个在大脑中广泛传播的共享“工作空间”时,它就会变得有意识地可及。我们在Claude的神经活动中发现了一组起着类似作用的表征。
关于研究的更多内容请查看:https://www.anthropic.com/research/global-workspace
来自频道: @DNSPODT
谷歌计划于7月17日推出Gemini 3.5 Pro模型,支持200万上下文窗口,引入“深度思考”推理模式,专为复杂智能体工作流设计,具备动作执行、多模态生成与长时程任务处理能力。测试显示其在SVG编码与前端生成方面超越Claude Fable 5 High,展现出更优的设计品味与智能体协作体验。
来源:HarshithLucky3
来源:HarshithLucky3
来自频道: @DNSPODT
来源:FinGraph财经图集
来自频道: @DNSPODT