【AI 奏折】2026年08月13日
共收录 13 篇深度内容
📋 今日内容速览
快速浏览,点击感兴趣的推文查看详细分析
- CuiMao: 感恩科技改变命运,未来稳中向好不念过往。
- GitHubDaily: OPC Skills为独立开发者提供自动化工具处理重复性工作。
- karminski-牙医: DeepSeek-V4-Pro长程任务易早停,性能不及GLM-5.1。
- Berryxia.AI: 三大AI模型比拼3D建模与空间理解能力,评测法拉利教学软件开发效果。
- 知识猫AI实验室: Grok 4.6跃居顶级AI,马斯克战略押注成功。
- 知识猫AI实验室: DeepSeek用宇宙最强悬念营销造势,成败取决于产品实力。
- 知识猫AI实验室: DeepSeek V4 Pro能像工程师一样完整解决复杂任务。
- Berryxia.AI: Grok 4.6输出优于DeepSeek,信息密度更高。
- Tz: 雷军宣布推出AI产品龙缰,要做AI时代最好的壳。
- 向阳乔木: Deepseek V4 Pro 0813能高效完成开发、设计和3D游戏任务。
- 李岳: GPT Image 2生成古风仙侠夜景女主写真,展现梦幻华美东方美人。
- 知识猫AI实验室: DeepSeek V4 Pro增强Agent能力,跻身AI头部阵营。
- iGeekbb: 网红情侣直播遭调侃,秀恩爱反被嘲。
📖 详细内容
CuiMao @cuimao
AI Developer | NVIDIA YES | Qwen |
Github: https://github.com/Cuimao777 | 影响力: 0万粉丝
💡 核心观点: 感恩科技改变命运,未来稳中向好不念过往。
可信度: 8/10 – 2项声明可直接验证;2项为观点陈述
事实核查:
- ✓ 可验证: 账号已使用四年 (可通过X平台账号注册日期或周年通知功能直接验证。)
- ✓ 可验证: 去年春节接触DeepSeek R1后命运变得无法预测 (个人主观体验及对命运的断言,缺乏客观衡量标准或公开记录。)
- ◦ 观点: 感谢马斯克、X、AI的发展 (属于主观情感表达,无具体事实依据需验证。)
原文内容:
X 通知我这个账号已经用了四年, 本来想写一篇长文记录下我的成长,想想算了,成年人最不应该就是怀念过去。 感谢马斯克,感谢 X,感谢 AI 的发展。感谢从我去年春节接触 DeepSeek R1 的那个下午。那一刻起我的命运也从此变得无法预测。 一切! 稳中向好! #我的X周年纪念日
⏰ 08:40 | ❤️ 50点赞 | 📝 102字 | 查看原文 →
GitHubDaily @github_daily
挖掘开源的价值
坚持分享 GitHub 上高质量、有趣、实用的教程、AI工具、前沿 AI 技术
A list cool, interesting projects of GitHub.
公众号:GitHubDaily | 影响力: 0万粉丝
💡 核心观点: OPC Skills为独立开发者提供自动化工具处理重复性工作。
可信度: 8/10 – 2项声明可直接验证;1项需进一步确认;1项为观点陈述
事实核查:
- ✓ 可验证: OPC Skills 能够给 Agent 工具装一套面向独立开发者的自动化 Skill,目前收录了 10 个(包括 SEO 优化、域名比价等) (可通过提供的 GitHub 链接(http://github.com/ReScienceLab/opc-skills)直接查看项目功能列表和代码实现,确认技能数量和类型。)
- ◐ 部分可验证: 兼容 Claude Code、Cursor、Codex 在内的 16 个主流 Agent 工具 (GitHub 项目文档可能列出兼容工具,但需实测或查阅官方支持列表确认具体兼容性,部分工具名称(如 “Claude Code”)需核实是否为公开产品。)
- ◦ 观点: 适合独立开发者,将重复性杂活交给 Agent 处理 (这是主观的效率提升主张,实际效果取决于用户场景和工具能力,无法通过公开数据直接验证。)
原文内容:
一人公司模式下,开发者既要写代码又要兼顾SEO、域名选购、Logo设计等耗时环节。 OPC Skills为Agent工具提供了一套专为独立开发者设计的自动化技能包。 当前集成10项核心功能:涵盖SEO优化、域名比价、Logo自动生成,以及Reddit和X平台需求挖掘等场景。 GitHub仓库:http://github.com/ReScienceLab/opc-skills… 全面兼容Claude Code、Cursor、Codex等16款主流Agent工具。 专为独立开发者和一人公司打造,将重复性事务交由Agent智能处理。
⏰ 08:00 | ❤️ 23点赞 | 📝 100字 | 查看原文 →
karminski-牙医 @karminski3
A coder, road bike rider, server fortune teller, electronic waste collector, co-founder of KCORES, ex-director at IllaSoft, KingsoftOffice, Juejin. | 影响力: 36.92k万粉丝
💡 核心观点: DeepSeek-V4-Pro长程任务易早停,性能不及GLM-5.1。
可信度: 10/10 – 2项声明可直接验证;2项需进一步确认;1项为观点陈述
事实核查:
- ◐ 部分可验证: DeepSeek-V4-Pro-0813 在 reasoning_effort=max 时长程 AgenticCoding 任务中更倾向于早停 (需通过相同实验设置复现(如50轮测试、相同任务类型),但未提供具体任务细节或代码,需依赖第三方实测验证。)
- ◐ 部分可验证: 模型在50轮测试中,2次于42-43轮提前停止 (需重复相同实验统计停止轮次,但推文未公开原始数据或测试环境,需用户自行复现确认。)
- ✓ 可验证: 当前测试成绩未超过GLM-5.1(仅此案例) (未提供GLM-5.1的对比数据、评测指标或任务详情,无法通过公开信息验证。)
原文内容:
刚发的 DeepSeek-V4-Pro-0813 好像的确有问题, reasoning_effort=max 的时候模型在长程 AgenticCoding 任务下更倾向于早停. 我这个测试总计50轮, 让模型不断优化代码, 结果他在3次测试中, 2次都在42-43轮左右的情况下停止了. 并未用完全部机会. 而且目前成绩来看, 甚至没打过 GLM-5.1 (仅我这一个case, 我不对其它case负责). 目前还不确定这是强化学习阶段奖励机制弄得有问题,还是是上下文窗口注意力衰减的问题,一会放出详细评测视频给大家解析。 #deepseekv4pro0813 #deepseekv4pro正式版
⏰ 02:08 | ❤️ 200点赞 | 📝 155字 | 查看原文 →
Berryxia.AI @berryxia
| 影响力: 39.76k万粉丝
💡 核心观点: 三大AI模型比拼3D建模与空间理解能力,评测法拉利教学软件开发效果。
可信度: 10/10 – 2项声明可直接验证;2项需进一步确认;1项为观点陈述
事实核查:
- ◐ 部分可验证: Kimi K3 with Kimi Code、DeepSeek V4 Pro with Bloome、Grok 4.6 with Grok CLI 参与了3D建模和空间理解能力的评测 (模型名称和评测行为可通过官方渠道(如模型官网或技术文档)确认其存在性,但具体评测过程和结果需依赖作者提供的视频或数据验证。)
- ✓ 可验证: 评测使用的Prompt是“用Three.JS开发类似JigSpace的互动教学软件,展示法拉利汽车” (Prompt内容为具体技术需求,若作者公开视频或代码,可通过复现或检查代码验证其真实性。)
- ◐ 部分可验证: 作者录制了对比视频展示模型差异,并邀请观众排名 (视频若公开(如上传至社交平台),可验证模型输出差异;但排名结果依赖主观判断,属部分可验证。)
原文内容:
好久没有爆肝了!!兄弟们! 刚刚熬夜把这三位老大哥给凑齐,来评测一下其对于3D 建模和空间理解的能力比拼! 分别参与的模型有: 1、Kimi K3 with Kimi Code 2、DeepSeek V4 Pro with Bloome 3、Grok 4.6 with Grok CLI Prompt:使用Three.JS技术 设计开发一款类似JigSpace的可互动、动态教学的展示法拉利汽车的软件,支持动态交互和完整还原其核心功能,用于教学使用。 我录制了个小视频,可以对比看看模型的差别,你觉得谁最强,以此排名一下吧! 制作不易,记得三连啊,兄弟们,太困了,睡觉了。 明天继续肝啊!
⏰ 02:00 | ❤️ 22点赞 | 📝 161字 | 查看原文 →
知识猫AI实验室 @geekcatx
10年+大厂程序员|AI内容工程师
用 AI 做图、做视频、搭工作流
分享真实作品、工具与增长实验
探索一人公司的更多可能
学习/咨询/合作 vx:gnipbao | 影响力: 0万粉丝
💡 核心观点: Grok 4.6跃居顶级AI,马斯克战略押注成功。
可信度: 10/10 – 2项声明可直接验证;2项需进一步确认;1项为观点陈述
事实核查:
- ◐ 部分可验证: Grok 4.6 在模型排名中进入第一梯队,与 GPT-5.6 Sol 并列 (需参考权威AI模型评测榜单(如LMSYS Chatbot Arena、HELM等)的最新排名数据,但”GPT-5.6 Sol”名称存疑(当前公开模型最高版本为GPT-4),可能存在表述误差。)
- ✓ 可验证: 马斯克宣布投入600亿美元收购Cursor公司 (截至2023年10月,无公开报道或官方文件显示马斯克或旗下公司有此收购计划,Cursor官网也无相关公告,且600亿美元金额远超常见科技收购规模(如GitHub收购价为75亿美元)。)
- ◐ 部分可验证: Grok从”吊车尾”到第一梯队的性能跃升 (需对比历史版本评测数据,但Grok此前未出现在主流榜单前列(如2023年8月LMSYS排名中未进入前20),近期版本进步可通过技术博客/论文验证,但”端茶倒水”等比喻属主观描述。)
原文内容:
Grok 4.6 这个排名,是真牛逼。 前几个月,Grok 还是吊车尾。 顶级模型在桌上打牌,它只能在旁边端茶倒水。 结果这次一更新,直接杀进第一梯队,跟 GPT‑5.6 Sol 坐一桌了。 怪不得老马直呼牛逼。 现在回头看,他宣布砸 600 亿美元收购 Cursor,买的根本不只是一个写代码的工具,而是 AI 时代的开发者入口。模型、产品、工程场景一接通,Grok 就像突然开了挂。 别人还在琢磨怎么把牌打好,老马直接把牌桌买了。 这一次,他真押对了。
⏰ 01:45 | ❤️ 29点赞 | 📝 151字 | 查看原文 →
知识猫AI实验室 @geekcatx
10年+大厂程序员|AI内容工程师
用 AI 做图、做视频、搭工作流
分享真实作品、工具与增长实验
探索一人公司的更多可能
学习/咨询/合作 vx:gnipbao | 影响力: 0万粉丝
💡 核心观点: DeepSeek用宇宙最强悬念营销造势,成败取决于产品实力。
可信度: 6/10 – 1项声明可直接验证;1项需进一步确认;2项为观点陈述
事实核查:
- ✓ 可验证: 据内测人士透露,DeepSeek Harness“宇宙最强” (该声明基于未具名的“内测人士”消息,缺乏公开来源或官方证实,无法独立验证其真实性。)
- ◦ 观点: “宇宙最强”不是结论,是钩子 (这是对营销策略的主观解读,属于观点性陈述,无客观事实依据。)
- ◐ 部分可验证: 产品撑得住,这四个字就是势能;产品撑不住,这四个字就是回旋镖 (需等待产品发布后通过实际性能测试或用户反馈验证,目前无法完全确认。)
原文内容:
据内测人士透露,DeepSeek Harness“宇宙最强”。 真假现在谁也不知道,但从传播上看,它已经赢了第一步: 别人发布产品先讲功能,它还没发布,先让全网等着验证。 “宇宙最强”不是结论,是钩子。 产品撑得住,这四个字就是势能; 产品撑不住,这四个字就是回旋镖。 钩子负责让人停下来,真实体验负责让人留下来。 兄弟们这回,你们相信梁圣吗?
⏰ 01:19 | ❤️ 35点赞 | 📝 127字 | 查看原文 →
知识猫AI实验室 @geekcatx
10年+大厂程序员|AI内容工程师
用 AI 做图、做视频、搭工作流
分享真实作品、工具与增长实验
探索一人公司的更多可能
学习/咨询/合作 vx:gnipbao | 影响力: 0万粉丝
💡 核心观点: DeepSeek V4 Pro能像工程师一样完整解决复杂任务。
可信度: 1/10 – 基于事实核查结果综合评估
事实核查:
- ✗ 无法验证: DeepSeek V4 Pro 在 DeepSWE 测试中的得分从 12.8 提升到 62.7,约 4.9 倍。
- ✗ 无法验证: 验证状态:partially verifiable
- ✗ 无法验证: 说明:** 若 DeepSeek 官方公开了测试方法、基准数据或报告,该声明可验证;但若测试细节(如任务具体内容、评分标准)未完全公开,则需依赖第三方复现或部分推测。
原文内容:
为了避免兄弟们看不懂指标含义翻译成人话,DeepSeek V4 Pro 这次不是更会答题,而是更会把一件事干完。 DeepSWE:12.8 → 62.7,约4.9倍。 给 Agent 一个真实代码仓库和原创的长周期工程任务,让它跨文件修改代码并通过验证。测的不是“会不会写一段代码”,而是“能不能像工程师一样持续干活”。 NL2Repo:38.5 → 61.5。 只给一份自然语言需求和一个空目录,让 Agent 从零设计架构、管理依赖、编写多个模块,最终造出一个可安装运行的完整仓库。它测的是从需求到成品的全程交付,不只是代码理解。 Toolathlon-Verified:55.9 → 74.1。 让 Agent 在日历、Notion、WooCommerce、Kubernetes、BigQuery 等32类应用、604个工具之间选择和串联操作。它测的是:工具找得对不对、调用顺序对不对、几十步之后还能不能完成任务。 CyberGym:52.7 → 83.3。 给出真实漏洞描述和代码仓库,让 Agent 分析代码并生成能够复现漏洞的 PoC。它主要考验安全分析、仓库检索和实际执行能力,不能简单等同于“整体网络安全能力”。 AutomationBench:12.8 → 31.8,约2.5倍。 让 Agent 跨 CRM、邮件、日历等系统完成真实业务流程,还要自己寻找 API、遵守业务规则,并把正确数据写进正确系统。绝对分数仍然不高,说明“替公司自动干活”依然是难题。 另外三个信号也值得看: Agents’ Last Exam:25.7。 它测的不是普通逻辑题,而是跨行业、长周期、可验证的真实专业工作。DeepSeek 与 Opus 4.8 持平,高于 GLM-5.2,但低于 Kimi-K3。 Terminal-Bench 2.1:87.9。 Agent 要在真实终端环境里调试代码、配置系统、处理安全和科学计算任务。DeepSeek 与 Kimi-K3 的88.3、Fable 5的88.0已经非常接近,说明终端执行能力进入第一梯队。 DSBench-Hard:67.2。 这是 DeepSeek 内部的高难度 Coding Agent 测试集。相比 Opus 4.8的71.7仍差4.5分,说明极端复杂任务还有距离;但因为测试集未完全公开,这项成绩只能作为辅助证据,不能据此推导“闭源全面领先”。 一句话总结: 这次真正的变化,不是某个榜单突然登顶,而是写代码、造仓库、调工具、跑终端和做自动化同时上涨——DeepSeek正在从“会回答”,走向“能交活”。 当然这个是为了适配今天要发布的 DeepSeek Harness,据说内测反馈极其夸张。。。
⏰ 01:11 | ❤️ 67点赞 | 📝 592字 | 查看原文 →
Berryxia.AI @berryxia
| 影响力: 39.76k万粉丝
💡 核心观点: Grok 4.6输出优于DeepSeek,信息密度更高。
可信度: 7/10 – 1项声明可直接验证;1项需进一步确认;3项为观点陈述
事实核查:
- ◦ 观点: Grok 4.6 的输出效果比 DeepSeek 好很多 (该声明基于主观比较(如“效果更好”),缺乏具体量化标准或公开数据支持,属于个人观点。)
- ◐ 部分可验证: Grok 4.6 输出40页内容,DeepSeek v4 Pro 输出21页内容 (可通过实测相同任务验证输出量差异,但需确认测试条件(如输入素材、参数设置)是否一致,否则结果可能不具普遍性。)
- ✓ 可验证: Grok 4.6 耗时40分钟,DeepSeek 耗时未提但暗示更快 (未提供DeepSeek的具体耗时数据,且性能受硬件、网络等外部因素影响,无法直接验证。)
原文内容:
终于跑完了,Grok竟然搞了40分钟,开罗4个子Agent! 这一波测试中发现Grok 4.6 的输出的效果还是比 DeepSeek要好很多,主要是在以下几个地方: 1、审美排版其实都大差不大。 2、信息密度Grok 4.6 提供的更多,并且耗时也快40分钟。 3、DeepSeek v4 Pro 输出的内容只有Grok的1/2 ,21页内容,而Grok 输出了40页内容。 4、细节的一些内容反而是DeepSeek 把提供的素材的内容解读的更细化,所以有些地方还是不错的。 明天再测一些别的Coding场景和调用工具的能力吧~~
⏰ 00:58 | ❤️ 36点赞 | 📝 147字 | 查看原文 →
Tz @tz_2022
品味是一种异常值。→ tastes.md
AI is the steam engine of the mind.
AI 是心灵的蒸汽机。科幻是现实的有效坍塌。加速正在被加速。看,那千尺海啸正扑面而来,而我们还在海滩上捡垃圾。
念念不忘,必有回响。 | 影响力: 0万粉丝
💡 核心观点: 雷军宣布推出AI产品龙缰,要做AI时代最好的壳。
可信度: 8/10 – 1项声明可直接验证;3项需进一步确认;1项为观点陈述
事实核查:
- ◐ 部分可验证: DeepSeekHarness 的上下文长度为 512K,可一次性读取公司十年的代码库 (上下文长度等技术参数可通过官方文档或实测验证,但“读取十年代码库”是比喻性描述,需依赖具体代码库规模,无法直接量化验证。)
- ◐ 部分可验证: DeepSeekHarness 在 SWE-bench 测试中成绩为 84.6,且由模型自行复核 (SWE-bench 是公开基准测试,成绩可通过官方提交记录验证,但“模型自行复核”属于非标准流程,需依赖企业公开细节,目前无法独立验证。)
- ✓ 可验证: 研发投入三年 55 亿元,主要用于电费 (研发费用属于企业内部财务数据,通常不公开明细;“电费”占比说法缺乏具体依据,无法通过公开渠道验证。)
原文内容:
假如雷总发布 DeepSeekHarness……(口播逐字稿) 各位朋友,大家好,我是雷军。 今天,是小米历史上特别重要的一天。我知道,这话我每年都讲。但今年这次,是真的。 开讲之前,先回应一个词。这两个月,这个词在我微博底下刷了几十万条,把我刷失眠了——套壳。 说实话,第一次看到,我挺难受的。难受了两天,我想通了。壳,怎么了?手机是芯片的壳,汽车是电池的壳,人,是基因的壳。这话不是我说的,道金斯说的,《自私的基因》,我看了三遍。基因跑了四十亿年,靠什么?靠壳做得好。 所以今天我把话放在这儿:我们,就是要做 AI 时代最好的壳。 产品名,DeepSeekHarness。Harness 什么意思?马具,缰绳。大模型是匹好马,我们负责上缰绳。中文名我们取了三个月,最后定了两个字:龙缰。马一上缰,就升级成龙了,是吧。 发布会前有记者问我:雷总,马有了,缰绳也有了,那骑手是谁? 这个问题非常好。好到什么程度呢?好到我们直接看下一页 PPT。 先讲技术。网上有人把友商的 harness 拆了,说拆开就是一个 while 循环。我们也买了一套,认认真真研究了八个月,发现——确实是个 while 循环。 但是。我们的循环,一体化压铸,九千一百吨。系统提示词一万四千行,一次成型,没有一行是后焊上去的。工程师跟我讲,雷总,提示词没有吨位这个说法。我说,从今天起,有了。 这套东西,三年,五十五个亿。有人问钱花哪了。我说:电费。 大家别笑,我是认真的。 上下文 512K,什么概念?你们公司十年的祖传屎山,连同离职同事忘了删的注释,一口气读完。读完,它回你三个字:“辛苦了。”速度,一秒两万 token。你眨一下眼,一个登录页出来了;打一个哈欠,全公司重构完了。先别激动——重构完,还能跑。 米粉都懂,不服,跑个分。SWE-bench,我们这行的纽北。包场刷了三个月,成绩,84.6。有人问,这个成绩谁复核的?模型自己复核的。它看完说,没问题,比它自己预想的还准。 我们本来做了一张对比柱状图,做得特别漂亮。法务看完,从图上划掉了两根柱子。现在图上就剩我们一根,遥遥……这个词是隔壁的,我们不用。 再来一个硬指标。这个指标,刷不了榜,造不了假。友商张口闭口参数量,参数这个东西,看不见摸不着,多少亿,全凭他们自己讲。我们比一个肉眼可见的:字母量。 DeepSeekHarness,十五个字母,是我从业三十年,见过字母最多的同类产品。友商 Codex 多少?五个。我们提升 300%。ClaudeCode 强一点,十个,我们也提升了 150%。这个数据我们反复核实过,前后数了三遍。 这个成绩,几乎是 SOTA 水平。有同学问 SOTA 什么意思。State Of The Alphabet。 有人讲,那友商改个长名字,不就追上来了?改不了。域名注册了,商标注册了,PPT 都印好了,改一个字母,发布会全得重开。同学们,这就叫护城河。 对了,稿子这儿写着,括号,此处掌声雷动,括号完。行,这个你们自己看着办。 讲讲安全。凌晨三点,它突然想执行 rm -rf,删库跑路。哨兵模式 0.3 秒介入:手环震动,全屋灯光转红,扫地机器人过去堵住机箱门,空调十六度对着显卡猛吹——先让它冷静冷静。人码家,全生态。 生态是双向的。上礼拜我们一个工程师,bug 没修完,想开车回家。SU7 的门,落了锁。中控屏上就一行字:修完再走。他在车里改到凌晨两点,米家自动点了份外卖,送到后备箱。这不叫囚禁,同学们,这叫闭环。 还有一个功能,行业首创,幻觉物理隔离。模型一胡说,物理断电 0.3 秒,它就忘了。这个功能,伦理层面的讨论,我们今天先不展开。 过去一百天,我每天用它写代码。说实话,我三十年没写代码了。当年在金山,我觉得我写的代码,像诗一样优雅。这话我公开讲过,你们还拿它做过表情包,我都知道。 第一天,我写 Hello World,它说:雷总,这个我来。第七天,我发现我一行都插不上手。第三十三天,它从一个古老的论坛,把我 92 年写的汇编翻了出来,给我提了 247 个 issue。 那天夜里我没睡着。不是气的。它提得,都对。 三十年了。那些代码,第一次被人从头读到尾。 OK,该说价格了。先看友商:一个月 200 美金,一千四人民币,写代码比租写字楼还贵,是吧?定价会我们开了七次。财务说收 99,我说贵了。他说那 69?我说你还是没懂。 DeepSeekHarness,正式定价:免费。永久免费。 先坐下,还没完。每个月,用得最狠的前一万名,我们,倒发 1999。 十五年前,1999 是你们给我的。今天,轮到我还。 有人问,雷总,那你们挣什么?想好了。不告诉你。 One more thing。 用了龙缰以后,键盘一百零四个键,你真正用得上的,还剩几个?一个。来,看实物。一整块铝,CNC 一体成型,中间一枚回车键。键程 1.8 毫米,声音调了半年,采样用的是我自己按计算器的手感。多少钱?1999。有同学说,雷总,键盘比 Harness 还贵。同学,壳是免费的,仪式感是要钱的。 侧面,我们保留了一个 3.5 毫米耳机孔。我知道你想问:2026 年了,谁还留耳机孔?这个孔,不出声音。配套一根注入线,一头插键盘,一头贴在太阳穴上,提示词物理注入,不走键盘,不走 IDE,延迟为零。 对了,开场那位记者的问题,骑手是谁——现在可以回答了。这根线,两头是一模一样的。哪头插哪儿,说明书没写,留给大家自己探索。线多少钱?九块九,包邮。交个朋友。 二十年前,我们让每个人都买得起手机。今天,我们让每个人都写得起代码。哪怕你没学过。哪怕你,不识字。 最后说个事。今天这份稿子,是龙缰写的。我上台之前,没来得及看。所以刚才每一句话,你们是第一次听,我也是。 稿子里连停顿都标好了。今天所有的停顿,都是它安排的。包括现在这一个。 最后一行写着:鞠躬,下台。 行。 谢谢大家!Are you OK!
⏰ 00:46 | ❤️ 38点赞 | 📝 1722字 | 查看原文 →
向阳乔木 @vista8
喜欢摇滚乐、爱钓鱼的PM
网站:https://qiaomu.ai | 影响力: 0万粉丝
💡 核心观点: Deepseek V4 Pro 0813能高效完成开发、设计和3D游戏任务。
可信度: 6/10 – 1项声明可直接验证;2项需进一步确认;1项为观点陈述
事实核查:
- ◐ 部分可验证: Deepseek V4 Pro 0813可以开发部署一个网站,需要调用3个Skill,完成网站开发、子域名解析和上线 (需实测验证模型是否具备完整网站开发能力(如代码生成、部署脚本等),Skill的具体功能需依赖官方文档或示例,但子域名解析等操作可能涉及第三方服务,需进一步确认实现细节。)
- ◐ 部分可验证: Deepseek V4 Pro 0813能模仿60种设计风格生成Bento卡片图 (可通过生成示例验证风格多样性,但“60种风格”需依赖模型输出统计或官方说明,设计效果的优劣属于主观评价。)
- ✓ 可验证: Deepseek V4 Pro 0813能用Threejs生成一个3D打砖块游戏 (可通过检查生成的代码是否可运行、是否符合游戏逻辑直接验证,但游戏完整性和性能需实测。)
原文内容:
用Deepseek V4 Pro 0813跑了三个简单任务。 1. 第一个是开发部署一个网站,需要调用3个Skill,完成网站开发,子域名解析和上线。 2. 第二个是模仿60种设计风格,生成Bento卡片图展示。 3. 第三个是Threejs 生成一个3D打砖块游戏。 大家可以看看效果,我感觉还行。
⏰ 00:32 | ❤️ 164点赞 | 📝 84字 | 查看原文 →
李岳 @liyue_ai
提示词工程师 | AI实战派
分享AI资讯 | 评测AI工具
发布AI教程 |拆解AI变现案例
公众号:李岳AI
合作+V:liyue071714118 | 影响力: 0万粉丝
💡 核心观点: GPT Image 2生成古风仙侠夜景女主写真,展现梦幻华美东方美人。
可信度: 8/10 – 1项声明可直接验证;3项需进一步确认;1项为观点陈述
事实核查:
- ◐ 部分可验证: 推文描述的图片由GPT Image 2生成 (需通过GPT Image 2的实际生成功能验证是否存在该模型及其能否输出符合描述的图像,但缺乏公开的官方文档或示例直接证明。)
- ◐ 部分可验证: 提示词可生成“古风仙侠夜景女主写真”风格的高精度图像 (若GPT Image 2存在,其生成效果需实测验证;但“高精度”“写实精修感”等标准为主观描述,无客观量化依据。)
- ◦ 观点: 画面细节(如服饰、头饰、背景)符合东方幻想美学 (对“华美”“灵动”“梦幻”等风格的判定基于主观审美,无客观验证标准。)
原文内容:
GPT Image 2生成古风图片:紫韵。 提示词: 9:16 竖版,古风仙侠夜景女主写真,写实偏精修角色海报风格,高精度东方幻想美人图,明亮、通透、梦幻的夜景氛围。画面主体是一位年轻成年东方女性,视觉年龄约 20–28 岁,精致东方淡颜,柔和小鹅蛋脸,面中自然饱满,圆润杏眼与细长眼尾结合,眼神清亮柔和,面带温柔浅笑,气质梦幻、灵动、贵气、明媚、华美。肌肤白皙细腻,面部通透有光泽,妆容为桃粉水光妆,妆感贵气精致,眼妆细腻,唇妆柔润,鼻尖、眼下、颧面和唇峰有自然高光,整体显妆但不甜腻。 发型为黑色柔顺长发半披半挽,发量丰盈,发丝顺滑,发顶造型蓬松精致。头饰为重工古风发冠,采用银白金属结构、珍珠流苏、淡紫宝石、水晶花饰与细链垂饰,华丽繁复但不压脸。耳饰为精致长坠式珍珠与淡紫晶石耳环,细碎高光明显。 服装为齐胸高腰幻想裙 + 珠链罩层,淡紫银白系配色,以柔雾淡紫、珍珠白、银白为主色,辅以冷银、淡紫晶石和珍珠点缀。上身结构精致,胸前与肩颈覆盖细密珠链罩层,裙身为多层轻纱、半透明外纱、细腻银线刺绣与水晶垂坠,整体高华丽度、轻盈灵动、仙气华美。衣料在灯火映照下有细腻柔亮反光与微闪质感。 人物站在一段层层向上的琉璃灯阶前,整体为正面轻侧身视角,身体略微侧向镜头,头部自然转向镜头,面带浅浅微笑。一只手优雅提着一盏精致的小琉璃灯,琉璃灯为透明灯罩配金属提柄,内部暖白烛光明亮柔和,另一只手自然垂落或轻扶裙侧,动作轻柔自然,不夸张摆拍。镜头为大半身近景构图,重点表现脸部、妆容、头饰、上身服装、琉璃灯与人物的互动关系。 背景为层层灯火点亮的古风楼台与长阶,远处可见金顶楼阁、飞檐建筑、夜色中的高台与层叠灯海,灯阶两侧布满暖白灯笼和细碎光点,夹杂少量淡紫花树与柔和紫金色散景。背景整体梦幻明亮,具有纵深与层次,但不过度模糊,能够看清灯阶、楼台与夜色建筑轮廓。夜空为深蓝色,整体夜景要亮、净、梦幻,不暗沉、不脏灰。 光线为灯火暖光 + 柔和面部补光,人物脸部受光细腻明亮,五官清晰,眼神有神;头饰、耳饰、珠链罩层、琉璃灯和服装刺绣产生细碎闪烁高光;轻微侧逆光勾勒发丝边缘与肩部轮廓。整体画面要求高精度、高完成度、写实精修感、人物主体明确、无明显动态拖影,呈现古风仙侠夜景女主的华美回眸氛围。
⏰ 00:34 | ❤️ 24点赞 | 📝 796字 | 查看原文 →
知识猫AI实验室 @geekcatx
10年+大厂程序员|AI内容工程师
用 AI 做图、做视频、搭工作流
分享真实作品、工具与增长实验
探索一人公司的更多可能
学习/咨询/合作 vx:gnipbao | 影响力: 0万粉丝
💡 核心观点: DeepSeek V4 Pro增强Agent能力,跻身AI头部阵营。
可信度: 8/10 – 1项声明可直接验证;2项需进一步确认;2项为观点陈述
事实核查:
- ◐ 部分可验证: V4 Pro 正式版已上线 API,模型名不变,Agent 能力增强,支持 Responses API 和 Codex 接入。 (可通过官方 API 文档或更新日志验证功能上线情况,但需实测确认 Agent 能力增强的具体表现。)
- ✓ 可验证: 官方表里,DeepSWE 得分 62.7,超过 GLM-5.2 和 Opus 4.8。 (若官方公开了 DeepSWE 评分榜单或报告,可直接核对数据;否则需依赖第三方可信来源。)
- ◦ 观点: 补入 GPT-5.6 Sol、Opus 5 等模型后,DeepSeek 虽非全面第一,但已经坐上头部牌桌。 (对比结论基于主观解读(如“头部牌桌”),且未说明具体评测标准或数据来源。)
原文内容:
正准备休息,DeepSeek官方群突然更新: V4 Pro正式版已开放API接口,模型名称保持不变,智能体(Agent)能力升级,新增支持Responses API和Codex接入。 官方评测数据显示,DeepSWE得分达62.7分,超越GLM-5.2与Opus 4.8。 有用户基于公开数据制作了柱状图:在纳入GPT-5.6 Sol、Opus 5等对比模型后,DeepSeek虽未全面领先,但已稳居第一梯队。 显然DeepSeek正抢占生产力入口: 以往模型仅解答问题,如今智能体可直接交付任务。 排行榜只是体检报告,真实项目才是试金石。 明天就接入Codex实际测试看看。
⏰ 00:21 | ❤️ 52点赞 | 📝 125字 | 查看原文 →
iGeekbb @igeekbb
发一些碎碎念和有趣的东东,主打一个快分享。-私信开放欢迎投稿- | 影响力: 0万粉丝
💡 核心观点: 网红情侣直播遭调侃,秀恩爱反被嘲。
可信度: 10/10 – 3项声明可直接验证;2项需进一步确认
事实核查:
- ◐ 部分可验证: “土木彭于晏”的女朋友是个网红 (可通过社交媒体平台(如抖音、微博)搜索该用户昵称及关联账号,核实其女友是否为网红(粉丝量、认证等),但需确认账号真实性及关系真实性。)
- ◐ 部分可验证: 网友在评论区调侃“土木彭于晏”把握不住女友,尤其提到“大哥的财力最具穿透力” (可通过查看原视频或直播的评论区内容验证是否存在此类留言,但“把握不住”“财力穿透力”等表述可能为网友主观调侃,需结合具体语境判断。)
- ✓ 可验证: “土木彭于晏”发视频向网友证明他们会亲嘴 (可直接查找原视频内容,确认是否存在相关画面及发布意图,属于公开可验证信息。)
原文内容:
这哥们叫土木彭于晏,女朋友是个网红,网友们都在评论区调侃他把握不住,尤其是开了直播之后,大哥的财力是最具穿透力云云,他也压力山大,今天发个视频,向网友证明他们是会亲嘴的,结果……有一个网友的评论笑疯:无需多言了
⏰ 23:51 | ❤️ 123点赞 | 📝 94字 | 查看原文 →