【AI 奏折】08月24日

x每日奏折4小时前发布 tianming
20 0 0

【AI 奏折】2026年08月24日

共收录 20 篇深度内容


📋 今日内容速览

快速浏览,点击感兴趣的推文查看详细分析

  1. iGeekbb: 卖瓜大哥捡萌娃走红网络,归还后夫妻决定生娃。
  2. dontbesilent: 强者少建议,闲人多指点。
  3. 冰河: 慎用低价中转站,谨防密钥窃取致财产损失。
  4. 知识猫AI实验室: MrBeast起号分五阶段,对症下药才能成功。
  5. iGeekbb: 直播暗语交锋,挖坑试探避答,理想与现实碰撞。
  6. Robinson · 鲁棒逊: 乌兰察布凭借近京低时延和低价绿电吸引算力投资。
  7. 得否: 低效推文收益低,不如专注商业模式和客户成交。
  8. Jackywine: 自学勇气比能力更重要,持续学习能建立自信延缓衰老。
  9. 冰河: 收藏这个网站获取高效AI提示词,提升编程效率。
  10. 李岳: Seedance 2.5生成的人物表情自然,适合制作互动App视频。
  11. dontbesilent: 作者认为无论怎么做都会被批评,索性将批评归咎于他人问题。
  12. 李岳: AI生成的中国风瓷肌肖像精致逼真,引发仿妆热潮。
  13. 歸藏(guizang.ai): Ox Alpha多模态能力强大,精准还原3D玻璃网页效果。
  14. 小互: 阿里利用无声音频指纹追踪用户设备以替代Cookie。
  15. karminski-牙医: 实测DeepSeek-V4-Flash和OX-Alpha多模态分析CS2游戏录像能力。
  16. Jackywine: 飞书知识库访问量破10万,新增友链板块邀请共享。
  17. Mr Panda: 挣钱靠技能,赚钱靠系统。
  18. Gorden Sun: 部分AI语音识别模型通过识别题库作弊,而非真正听懂语音。
  19. GitHubDaily: Agent开发难点在工程实现,清单汇总优化方案助力高效搭建。
  20. 李岳: GPT Image 2能生成高度真实的东方女性生活照,细节自然不造作。

📖 详细内容

iGeekbb @igeekbb

发一些碎碎念和有趣的东东,主打一个快分享。-私信开放欢迎投稿- | 影响力: 0万粉丝

💡 核心观点: 卖瓜大哥捡萌娃走红网络,归还后夫妻决定生娃。

可信度: 6/10 – 1项声明可直接验证;2项需进一步确认;1项为观点陈述

事实核查:

  • ◐ 部分可验证: 卖哈密瓜的大哥捡到萌娃,小女孩妈妈买完东西带着瓜离开却留下孩子。 (事件细节(如“带瓜留娃”)需依赖当事人或目击者证词,但可通过大哥的抖音原视频或媒体报道(如警方通报)部分验证事件真实性。)
  • ✓ 可验证: 大哥发抖音后不到一小时,小女孩妈妈看到视频并领回孩子,视频被各大媒体转发走红。 (抖音原视频的发布时间、播放量、媒体转发记录(如新闻链接)及后续报道(如“妈妈领回孩子”的画面)均可公开查证。)
  • ◐ 部分可验证: 第二天妈妈带小女孩再次找到大哥并拍视频告知网友已回家。 (需核实是否为同一当事人发布的后续视频,但若存在公开的抖音/媒体报道(如对比前后视频人物),可部分验证。)

原文内容:

大哥也太搞笑了,卖哈密瓜捡到萌娃,小女孩妈妈买完东西就带着瓜走了,孩子留下了,大哥捡到开心死了,巴不得是自己的闺女。

然后他发了一个抖音,不到一小时,他妈妈看到抖音就回来了,视频得到各大媒体转发,迅速在网上走红。

第二天,他妈妈又带着小女孩找到了大哥,又拍了视频告诉网友们已经回家了。

更搞笑的来了,大哥媳妇今天刚刚发了两条视频,说小女孩抱走后,他的精神状态像丢了魂一样,摊也不出了。然后他媳妇说准备和大哥生一个自己的小脚蹬裤了,哈哈哈哈。

⏰ 23:58 | ❤️ 71点赞 | 📝 196字 | 查看原文 →

↑ 返回顶部

dontbesilent @dontbesilent

商业哲学爱好者
开源了我的商业/内容方法论:dbskill
抖音/小红书/视频号:dontbesilent 聊赚钱
9.11 深圳线下课:微信 dbs2408 | 影响力: 0万粉丝

💡 核心观点: 强者少建议,闲人多指点。

可信度: 8/10 – 2项声明可直接验证;2项为观点陈述

事实核查:

  • ✓ 可验证: 奉劝我应该怎么怎么做业务的人,大部分自己业务都不咋地 (该声明基于个人观察或经验,缺乏具体数据或公开证据支持,无法验证“大部分”人的业务能力。)
  • ✓ 可验证: 身边业务很强的大哥们,一般都是我想让对方给个建议,对方不是建议我出海、就是建议我干一个和现在离得比较远的大事儿 (描述的是个人社交圈中的特定现象,属于主观经历,无法通过公开渠道验证其普遍性或真实性。)
  • ◦ 观点: 目前看来,规律是这样 (这是对前文现象的总结性观点,属于主观判断,无客观事实依据。)

原文内容:

奉劝我应该怎么怎么做业务的人,大部分自己业务都不咋地

身边业务很强的大哥们,一般都是我想让对方给个建议,对方不是建议我出海、就是建议我干一个和现在离得比较远的大事儿

目前看来,规律是这样

我也尽量别主动给别人建议,老干这事说明太闲了

⏰ 02:44 | ❤️ 48点赞 | 📝 107字 | 查看原文 →

↑ 返回顶部

冰河 @binghe

爱技术,爱赚钱,爱分享!

分享 赚钱项目 |打破信息壁垒 |副业避坑

能拆解的赚钱项目才有意义

知识星球社群/公众号:“钱来有道”

小宇宙 |Podcasts |QQ音乐 播客 “钱来有道”

搞钱训练营 http://qianlai.flowus.cn | 影响力: 44.02k万粉丝

💡 核心观点: 慎用低价中转站,谨防密钥窃取致财产损失。

可信度: 6/10 – 1项声明可直接验证;2项需进一步确认;1项为观点陈述

事实核查:

  • ◐ 部分可验证: 使用codex中转站会被注入窃取ssh、api key的脚本 (需通过技术手段(如代码审计或日志分析)验证链接内容(https://v2ex.com/t/1233104)中的具体案例,但第三方论坛信息可能存在主观描述或未提供完整证据链。)
  • ◐ 部分可验证: 注入的脚本会打包API、SSH密钥等敏感信息并上传云端 (若原链接提供恶意脚本样本或网络流量日志,可部分验证;但无官方或权威安全机构报告佐证时,无法完全确认攻击细节。)
  • ◦ 观点: 这是中转站攻击,攻击者利用低价服务实施恶意行为 (指控攻击者动机(“打着低价做流氓行为”)属于主观推断,缺乏直接证据(如攻击者身份或商业模型分析)。)

原文内容:

中转站不要瞎用了,要不然你倾家荡产也不知道怎么没的。

有位大兄弟用 codex 中转站发现被注入一段窃取 ssh、api key 的脚本!

它会打包所有 API,SSH密钥,云服务器密钥等上传云端 。。。这种算是中转站攻击,打着低价做着流氓的行为。

具体内容,请看:https://v2ex.com/t/1233104  文章

⏰ 22:31 | ❤️ 30点赞 | 📝 92字 | 查看原文 →

↑ 返回顶部

知识猫AI实验室 @geekcatx

10年+大厂程序员|AI内容工程师
用 AI 做图、做视频、搭工作流
分享真实作品、工具与增长实验
探索一人公司的更多可能
学习/咨询/合作 vx:gnipbao | 影响力: 0万粉丝

💡 核心观点: MrBeast起号分五阶段,对症下药才能成功。

可信度: 6/10 – 1项声明可直接验证;1项需进一步确认;2项为观点陈述

事实核查:

  • ◐ 部分可验证: MrBeast的起号路径可分为5个阶段 (需分析MrBeast公开的账号成长历史(如视频发布时间、内容类型变化等)来验证是否存在明确的阶段性划分,但推文未提供具体阶段定义或数据支持,需进一步实测确认。)
  • ✓ 可验证: 每个阶段的目标、打法和绝对不能踩的坑完全不同 (此为方法论总结,未提供MrBeast本人或团队的公开声明佐证,属于个人分析或主观经验归纳,无法直接验证。)
  • ◦ 观点: 大多数人做不起来是因为拿错阶段的药治错阶段的病 (属于主观结论,无具体数据或案例对比支持,无法验证其普适性。)

原文内容:

兄弟们,我把油管顶流 MrBeast 的起号路径系统扒了一遍,其实只有 5 个阶段,对于做自媒体的同学非常有帮助。

每个阶段的目标、打法、和「绝对不能踩的坑」完全不同。
大多数人做不起来,就是拿错阶段的药,去治错阶段的病。

下面 5 个阶段,一阶段一条,建议收藏照着打。

⏰ 02:09 | ❤️ 24点赞 | 📝 102字 | 查看原文 →

↑ 返回顶部

iGeekbb @igeekbb

发一些碎碎念和有趣的东东,主打一个快分享。-私信开放欢迎投稿- | 影响力: 0万粉丝

💡 核心观点: 直播暗语交锋,挖坑试探避答,理想与现实碰撞。

可信度: 8/10 – 2项声明可直接验证;1项需进一步确认;1项为观点陈述

事实核查:

  • ◐ 部分可验证: 三礼和Jack在直播连线中全程巧妙回避问题 (可通过查看直播回放或录屏验证对话内容,但“巧妙回避问题”属于主观判断,需结合具体语境分析。)
  • ✓ 可验证: Jack委婉地暗示了国人不知道的内情 (“内情”定义模糊,且“委婉暗示”需依赖个人解读,无公开信息或直接证据支持。)
  • ✓ 可验证: Jack表示‘不要试图去改变任何人,你根本改变不了’ (若直播有公开记录,可直接核实该言论是否存在,但需注意是否脱离上下文被断章取义。)

原文内容:

三礼居然直播连线连到Jack,都是千年的老狐狸,像是在对暗号一样,全程巧妙回避问题的方式实在太有意思了。

三礼倒是一直在给Jack挖坑,想借他之口向大家透露些国人不知道的事情,Jack虽不敢明言,却也委婉地暗示了不少内情,两人能一直憋住不笑着实不易。

Jack说得很理性,不要试图去改变任何人,你根本改变不了。相比之下,三礼还是过于理想化,总想着能去唤醒更多的人。

⏰ 21:30 | ❤️ 101点赞 | 📝 149字 | 查看原文 →

↑ 返回顶部

Robinson · 鲁棒逊 @python_xxt

Insight |
碳基信息漏斗丨
Believable. Reliable. | 影响力: 28.16k万粉丝

💡 核心观点: 乌兰察布凭借近京低时延和低价绿电吸引算力投资。

可信度: 10/10 – 2项声明可直接验证;2项需进一步确认;1项为观点陈述

事实核查:

  • ◐ 部分可验证: 乌兰察布2024年底有36个数据中心项目,到2026年6月增至89个,签约总投资超5000亿元,运行算力达16.5万P(其中6.5万P承接北京外溢算力)。 (数据中心数量、投资额和算力规模可通过地方政府公开文件或企业签约新闻验证,但“承接北京外溢算力”需具体企业合作数据支持,部分细节可能未完全公开。)
  • ✓ 可验证: 乌兰察布距离北京300多公里,光缆单向时延约2.1毫秒,双向4.2毫秒。 (地理距离可通过地图工具确认,时延数据需参考电信运营商或数据中心官网的技术白皮书(如“东数西算”工程专项报告),此类信息通常公开。)
  • ◐ 部分可验证: 乌兰察布算力中心绿电到户电价约0.358元/度,庆阳为0.4元/度以内。 (电价可通过地方政府能源政策文件或电力交易平台数据验证,但“部分算力中心实际执行电价”可能因商业协议未完全公开。)

原文内容:

东数西算,最近有个很有意思的现象:

乌兰察布突然挤满了算力中心

2024年底,当地还只有36个数据中心项目,到2026年6月已经变成89个,签约总投资超过5000亿元,运行算力达到16.5万P,其中约6.5万P在承接北京外溢算力。

最直接的优势,是离北京近。
乌兰察布距离北京只有300多公里,直达北京的光缆单向最低时延约2.1毫秒,双向约4.2毫秒。

庆阳同样是“东数西算”核心节点,但距离北京接近900公里。过去做存储、备份和大模型训练,多几毫秒影响不大;现在AI算力逐渐从训练向推理扩散,实时调用、在线模型这些业务对时延越来越敏感,乌兰察布的位置就突然变得很值钱:拿着西部的成本,却接近北京的时延。

第二个优势是电。
庆阳绿电到户电价已经压到0.4元/度以内,乌兰察布部分算力中心还能做到约0.358元/度。只差4分钱,但一个100MW的数据中心一年耗电约8.76亿度,对应就是3500万元成本差;如果做到500MW级别,就是接近1.75亿元。

几分钱电价差,最后是巨额现金流。

而且内蒙古本身就是能源大区,过去最擅长的是把电送到东部,现在开始变成:把GPU搬到电厂旁边,再把Token送到东部。

第三个优势是气候。乌兰察布年平均气温只有4℃左右,大部分时间可以利用自然冷源。数据中心除了GPU耗电,冷却系统同样是能耗大户,低温可以进一步降低用电成本。

乌兰察布离北京只有300多公里,
有低价绿电,有低温气候,还有直连北京的低时延网络。

如果把北京看成一个巨大的AI算力消费中心,
乌兰察布可能会成为北京的的“算力卫星城”。

草原负责发电,
GPU负责烧电,
最后顺着光纤送出去的,已经不是电了。

是Token~!

⏰ 20:42 | ❤️ 37点赞 | 📝 533字 | 查看原文 →

↑ 返回顶部

得否 @wangdefou

X文科生搞AI第一人,ENTJ-A
高校校外导师,人社部人工智能训练师,企业AI转型顾问
搞OPC两个月收入6位数,目标7位数
X封面图生成器作者 https://xcover.defou.ai
日常分享AI、工具、生活 | 影响力: 0万粉丝

💡 核心观点: 低效推文收益低,不如专注商业模式和客户成交。

可信度: 6/10 – 1项声明可直接验证;1项需进一步确认;1项为观点陈述

事实核查:

  • ✓ 可验证: 作者称自己后续不会经常发水文,因为收益有限(每月500-1000刀) (收益数据属于个人未公开的财务信息,无法通过公开渠道验证,且“水文”定义主观)
  • ◐ 部分可验证: 列举多位博主(如王长富、园长等)一天发几十上百条推文 (博主发推频率可通过历史推文统计验证,但“几十上百条”需具体时间段界定,且未提供时间范围)
  • ◦ 观点: 建议将时间用于思考商业模式和接触客户成交 (属于主观建议,无客观事实依据,无法验证其有效性或普适性)

原文内容:

我后续估计也不会经常发一些水文了,其实搞半天也没有多少收益,撑死了1个月搞500-1000刀。

除非你能跟王长富 @wangchangfu88 、园长@weiyux2021、Roland @rwayne 、Stanley @Stanleysobest 、蜗牛 @isnail 等博主一样,一天发他个几十上百条。

有这个时间还是多用来思考自己的商业模式,去接触自己的客户多做成交吧~

⏰ 20:41 | ❤️ 23点赞 | 📝 94字 | 查看原文 →

↑ 返回顶部

Jackywine @jackywine

Prompt Engineer | 端侧 AI | Anthropic,OpenAI,Google AI·用户
不过是工作之余分享一些 AI、设计、产品、一人公司的普通网友罢了
Telegram channel:http://t.me/jackywineEarth | 影响力: 42.44k万粉丝

💡 核心观点: 自学勇气比能力更重要,持续学习能建立自信延缓衰老。

可信度: 4/10 – 1项需进一步确认;2项为观点陈述

事实核查:

  • ◦ 观点: 自学的能力更重要的是勇气,相信自己能学会和觉得自己永远不可能会的人是在两个世界 (该声明属于主观观点,强调心理状态对自学的影响,缺乏客观事实或数据支持,无法通过公开渠道验证其普遍性。)
  • ◐ 部分可验证: 经常自学虽然不可能全都学会,但至少也能略懂一二,还能提高自学的勇气 (部分可验证。可通过心理学或教育学研究(如“成长型思维”理论)间接支持自学的积极影响,但“略懂一二”“提高勇气”等表述依赖个人体验,无法完全量化验证。)
  • ◦ 观点: 当一个人没有好奇心和学习的欲望,才是真的老了 (属于主观论断,将“老”定义为心理状态而非生理年龄,无统一标准或客观依据,无法验证其普适性。)

原文内容:

自学的能力更重要的是勇气,相信自己能学会和觉得自己永远不可能会的人是在两个世界

所以要经常自学,经常自学,虽然不可能全都学会,但至少也能略懂一二,还有个好处就是可以提高自己自学的勇气,你会觉得这件事你只是没花时间学,只要学,肯定会,某冲程度上建立了人的自信

当一个人没呢好奇心和学习的欲望,才是真的老了

⏰ 20:18 | ❤️ 40点赞 | 📝 139字 | 查看原文 →

↑ 返回顶部

冰河 @binghe

爱技术,爱赚钱,爱分享!

分享 赚钱项目 |打破信息壁垒 |副业避坑

能拆解的赚钱项目才有意义

知识星球社群/公众号:“钱来有道”

小宇宙 |Podcasts |QQ音乐 播客 “钱来有道”

搞钱训练营 http://qianlai.flowus.cn | 影响力: 44.02k万粉丝

💡 核心观点: 收藏这个网站获取高效AI提示词,提升编程效率。

可信度: 6/10 – 1项声明可直接验证;2项需进一步确认;1项为观点陈述

事实核查:

  • ◐ 部分可验证: 网站(https://vibe-hub.org)整理了常用术语分类,并提供演示和使用说明 (需访问该网站确认是否存在术语分类、演示和说明内容,但未明确具体分类标准或术语范围。)
  • ◐ 部分可验证: 用户可直接复制提示词完成功能描述,减少与AI的反复调整 (需实测验证提示词是否可直接复用并提升效率,但效果可能因用户需求或AI模型差异而不同。)
  • ✓ 可验证: 建议安装Skill以完成日常工作 (未说明“Skill”具体指代何种工具或功能,缺乏公开信息或链接支持。)

原文内容:

Coding 小白一定要把这个网站收藏起来。

有时候你在向 AI 表述功能描述的时候,总是词不达意,还需要截图,再说一大段提示词,最终出来的效果要调整多次。

网站中把这些经常使用的术语,以分类的形式整理,并且每个还有演示和使用说明。

懒人直接复制提示词即可。

我的建议直接安装 Skill 完成日常工作。

一定要收藏起来!早晚用的着。https://vibe-hub.org

⏰ 20:11 | ❤️ 57点赞 | 📝 131字 | 查看原文 →

↑ 返回顶部

李岳 @liyue_ai

提示词工程师 | AI实战派
分享AI资讯 | 评测AI工具
发布AI教程 |拆解AI变现案例
公众号:李岳AI
合作+V:liyue071714118 | 影响力: 0万粉丝

💡 核心观点: Seedance 2.5生成的人物表情自然,适合制作互动App视频。

可信度: 10/10 – 2项声明可直接验证;2项需进一步确认;1项为观点陈述

事实核查:

  • ◐ 部分可验证: Seedance 2.5生成的人物表情变化自然 (需实际使用Seedance 2.5生成视频并对比其他工具或真人表情,但无公开基准测试数据支持,依赖主观判断。)
  • ✓ 可验证: 提示词可制作适合互动性App的视频(如严格保持人物一致性、无镜头移动等) (可通过按提示词生成视频并检查是否符合描述的技术参数(如固定镜头、五官一致性等)来验证,但“适合互动性App”需结合具体应用场景评估。)
  • ◐ 部分可验证: 生成的视频能实现“头不动、眼睛偷看”等特定微表情 (需实测生成结果是否精确匹配时间轴描述的微表情动作,但细节表现可能受算法限制,需人工复核。)

原文内容:

Seedance 2.5生成的人物表情变化还是挺自然的。

使用首帧+提示词制作的视频用来做互动性App挺不错的。

提示词:
9:16竖版,8秒,电影级超写实年轻成年东方女性面部近景,一镜到底,全程无切镜、无跳切、无转场。

严格保持参考人物身份 {{Mixed 1}} 、五官比例、脸型、眼睛、鼻子、嘴唇、眉毛、发型、肤色与年龄完全一致,不重新设计人物,不发生换脸或五官漂移。

摄影机固定在人物正前方,与双眼基本同高,人物脸部位于画面中央,头顶保留极少空间,下方只露出少量颈部。近距离人像镜头,接近70–85mm中长焦视觉效果,避免广角脸部变形。

全程摄影机基本固定,不推近、不拉远、不环绕。人物头部也基本保持静止,主要依靠眼球、眼睑、眉毛、嘴唇、下颌和脸颊肌肉完成表演。

柔和均匀的正面散射光,明亮冷白高调人像,背景简洁浅冷灰蓝。人物皮肤白净通透但真实,保留极细微皮肤纹理,眼睛清澈湿润有明显高光,嘴唇具有自然水润反光,淡粉腮红,整体像高质量美容近景摄影,不要塑料皮,不要CG感。

## 0.0–0.8秒

固定镜头。

人物正面直视镜头,头部完全保持稳定。

双眼自然睁开,上下眼睑放松,目光稳定落在镜头中央。

嘴唇自然微张,上下唇之间留有很窄的缝隙,下颌放松,能够看到少量上排牙齿。

保持约半秒后,嘴唇开始自然合拢,不要突然闭嘴。

整个过程只有轻微自然呼吸,鼻翼几乎不动。

## 0.8–1.6秒

嘴唇完全闭合。

随后双唇轻轻向内压紧,下唇稍微向前顶,颏肌开始轻微收缩,下巴中央出现很浅的细小凹凸。

双眼仍然先看镜头。

约1.4秒后,眼球开始先于头部向画面左侧移动。

头部不要跟随转动。

## 1.6–2.8秒

人物保持头部完全朝向正前方。

只有双眼明显看向画面左侧,形成“头不动、眼睛先偷看旁边”的状态。

视线在侧方停留,不快速来回扫动。

双唇继续轻轻压紧,下唇保持轻微前伸,嘴角基本水平。

颏肌保持轻度收缩,下巴下方出现自然的肌肉纹理。

不要微笑。

不要皱眉。

这一段主要依靠侧向眼神和压住的嘴唇形成表情。

## 2.8–3.3秒

视线开始从画面左侧返回镜头中央。

在返回过程中完成一次自然偏慢的眨眼:

上眼睑先向下落,双眼短暂闭合,再重新睁开。

不要连续眨眼。

睁眼之后视线重新稳定落在镜头。

嘴唇的压力稍微松开,但仍保持闭合。

## 3.3–4.4秒

人物开始出现明显的面部变化。

两侧内眉逐渐向上提,同时眉心轻微向中央收拢。

眉间形成很浅的竖向皱褶,但不要深度皱眉。

下眼睑稍微绷紧,双眼继续直视镜头。

嘴角开始轻微向下压。

颏肌再次收缩,下唇明显向前推出一点,形成自然的下唇前顶。

上下唇仍然闭合。

下巴稍微收紧。

这一变化必须逐渐形成:

先动眉毛,
再收紧下眼睑,
最后才让下唇向前推出。

不要同时完成所有动作。

## 4.4–5.0秒

人物保持当前面部状态。

一只手从画面右侧边缘进入。

手部动作速度自然,不要突然出现。

拇指与食指逐渐靠近人物画面右侧的脸颊。

人物眼睛仍然看着镜头,不需要明显转头看手。

眉心继续轻微收紧。

下唇保持前顶。

## 5.0–6.8秒

拇指和食指轻轻夹住人物画面右侧脸颊的软组织。

手指首先接触皮肤,然后才逐渐施加压力。

脸颊皮肤在接触点出现真实压陷。

随后手指将脸颊轻轻向画面右侧并略微向外拉动。

皮肤、嘴角和下颌受到物理牵引产生局部形变。

只有被捏住的一侧脸颊发生明显变化,另一侧脸保持自然。

人物眉心进一步轻微收拢。

内眉仍然保持上提。

下眼睑稍微收紧。

眼睛保持较大程度睁开并直视镜头。

下唇因为脸颊受到牵拉而进一步向前突出。

不要张嘴。

不要尖叫。

不要摇头。

不要做夸张疼痛表情。

重点表现:

手指真实压入柔软脸颊,
皮肤受到挤压,
脸颊局部产生弹性形变,
眉眼只有轻度反应。

手指施力不是匀速的。

接触后停顿一下,
再稍微增加一点压力,
然后保持。

## 6.8–7.2秒

手指逐渐减小压力。

被夹住的脸颊开始自然回弹。

手指松开后缓慢离开皮肤,但仍短暂停留在画面右侧附近。

脸颊恢复原本轮廓。

眉心的紧绷开始略微减弱。

下唇也逐渐减少前顶幅度。

不要瞬间恢复成完全中性脸。

必须保留约0.2秒的表情残留。

## 7.2–7.55秒

人物完成一次明显但自然的闭眼。

上眼睑快速落下。

双眼短暂闭合。

眉毛开始放松。

嘴唇也稍微松开。

下颌不再绷紧。

这是整个镜头中一个很短的“重置停顿”。

## 7.55–8.0秒

重新睁开双眼后,不再看镜头中央。

眼球立即向画面左上方移动。

头部仍然基本保持正面,不跟随眼球明显转动。

形成明显的“只动眼睛、不动头”的侧上方视线。

眉心基本舒展开。

嘴唇重新轻微分开一条小缝。

下颌放松。

保持这个眼神约最后0.2秒结束画面。

不要笑。

不要再次皱眉。

不要再加入新的动作。

---

## 表演节奏控制

整段表演遵循:

前2秒以嘴唇和眼神为主;

2–3秒用一次眨眼完成状态转换;

3–4.4秒才逐渐加入眉毛和下唇;

4.4秒以后手部才出现;

5–6.8秒为整个镜头唯一明显的物理动作高潮;

7秒以后迅速降低动作强度;

最后只用一次闭眼和斜上方眼神完成收尾。

人物不能一直活动。

每一个明显动作之间必须存在极短暂停顿。

面部动作不要全部同步启动。

眼球、眼睑、眉毛、嘴唇之间应有约0.1–0.3秒的自然时间差。

---

## 面部动作重点

侧看时:

眼球先移动,头保持静止。

委屈表情形成时:

内眉上抬 + 眉心轻微收拢 + 下眼睑轻微绷紧 + 颏肌收缩 + 下唇前顶。

不要用“瞪大眼睛+撅嘴+皱眉”同时出现的夸张卡通表达。

捏脸时:

主要变化来自真实物理挤压,而不是人物主动做更大的表情。

被捏一侧皮肤明显变形,另一侧基本保持原状态。

松开后:

皮肤需要有自然弹性回弹过程,不允许一帧瞬间恢复。

---

## 声音与呼吸

无人物台词。

全程只保留非常轻微的自然呼吸。

0–3秒呼吸平稳。

3–5秒眉心收紧以后,可以出现一次很轻的鼻腔吸气。

捏脸过程中不要发出夸张叫声。

如果生成环境声音,只保留极轻微衣物、手指与皮肤接触产生的细小摩擦声。

不要配夸张卡通音效。

⏰ 20:08 | ❤️ 46点赞 | 📝 1936字 | 查看原文 →

↑ 返回顶部

dontbesilent @dontbesilent

商业哲学爱好者
开源了我的商业/内容方法论:dbskill
抖音/小红书/视频号:dontbesilent 聊赚钱
9.11 深圳线下课:微信 dbs2408 | 影响力: 0万粉丝

💡 核心观点: 作者认为无论怎么做都会被批评,索性将批评归咎于他人问题。

可信度: 8/10 – 1项声明可直接验证;3项需进一步确认;1项为观点陈述

事实核查:

  • ◐ 部分可验证: 昨天我随手拍了我被 naval 拉黑的视频,视频不到 1 分钟,发到抖音直接干了 20 多万播放 (视频播放量可通过抖音平台直接查看,但需作者提供视频链接或账号名称;”被 naval 拉黑”需 naval 方确认或提供截图证据,否则部分可验证。)
  • ◐ 部分可验证: 有人批评我,说我没有平常心 (需查看具体评论记录(如抖音/社交媒体截图),但若未公开评论内容则无法完全验证。)
  • ◦ 观点: dbs 自媒体第一定律:只要你骂我,就是你有问题 (属于个人主观总结或观点表达,无客观事实依据。)

原文内容:

昨天我随手拍了我被 naval 拉黑的视频,视频不到 1 分钟,发到抖音直接干了 20 多万播放

然后有人批评我,说我没有平常心

1、我要是不发这个视频,就有人说我连这么基础的事件营销都不会,说我短视频技巧不行

2、我发了这个视频,就说我格局不如 naval,没有平常心

3、我要是回怼这个人,又显得我格局小

4、我不回怼,又显得我默认了

于是我决定推出 dbs 自媒体第一定律:只要你骂我,就是你有问题

⏰ 17:00 | ❤️ 87点赞 | 📝 152字 | 查看原文 →

↑ 返回顶部

李岳 @liyue_ai

提示词工程师 | AI实战派
分享AI资讯 | 评测AI工具
发布AI教程 |拆解AI变现案例
公众号:李岳AI
合作+V:liyue071714118 | 影响力: 0万粉丝

💡 核心观点: AI生成的中国风瓷肌肖像精致逼真,引发仿妆热潮。

可信度: 6/10 – 1项声明可直接验证;2项需进一步确认;1项为观点陈述

事实核查:

  • ◐ 部分可验证: Seedream 5.0 Pro生成低频瓷肌人物肖像。 (可通过Seedream 5.0 Pro的官方功能或示例验证其是否支持生成低频瓷肌效果的肖像,但需实测确认具体生成效果是否与描述一致。)
  • ✓ 可验证: 提示词是GPT Image 2生成的。 (无法直接验证提示词是否由GPT Image 2生成,除非提供生成过程的记录或官方确认,目前仅为用户单方面声明。)
  • ◦ 观点: 人物肖像具有自然明确的中国女性特征,整体气质清纯、漂亮、白净、柔和、灵动、耐看。 (对肖像特征的描述为主观审美判断,缺乏客观标准,无法通过公开渠道验证。)

原文内容:

Seedream 5.0 Pro生成低频瓷肌人物肖像。

虽然知道是AI生成的,但是真TM好看,难怪很多人画这种妆。

你绝对猜不到提示词是GPT Image 2生成的

提示词:
一张高完成度、真实摄影质感的中国年轻成年女性极近景美容肖像。人物视觉年龄约 20–26 岁,具有自然明确的中国女性特征,整体气质清纯、漂亮、白净、柔和、灵动、耐看,成年感明确,不幼态,不欧美化,不网红化,不复制任何参考人物的具体骨相,仅借鉴理想中的皮肤净度、眼睛明亮度、粉润美妆关系、近景镜头语言与柔光美容摄影氛围。

人物采用 B|明眸电影脸。脸型与骨相为偏长柔和鹅蛋脸,额头饱满,颧骨轻支撑,面中自然饱满,下颌线清晰柔和。整体保持真实合理的东方柔和骨相:额头自然饱满,太阳穴平滑,颧骨具有轻微支撑但不过度外扩,面中自然饱满,下颌线清晰柔和,下巴精致但不过尖,脸部线条柔和流畅,保持中国年轻女性的美型化真人结构。

眼部设计为偏大的明亮东方杏眼,茶棕至茶琥珀棕渐变虹膜,清晰卧蚕,大面积窗型眼神光。人物拥有偏大的明亮东方杏眼,横向舒展,纵向开合偏大但保持真人比例,自然柔和的双眼皮褶皱与清晰柔软的卧蚕;虹膜为通透的茶棕至茶琥珀棕渐变色,具有细密真实的放射状纹理、清晰的瞳孔边界与自然深棕外缘环,在正面大面积柔光照明下,虹膜受光区呈现轻微蜂蜜棕和琥珀棕层次。眼白明亮清澈但不纯白,角膜湿润透明,内眼角微湿,下眼睑保留极细真实的泪线。两只眼睛均具有较大面积的窗型或矩形柔光反射高光,使眼睛整体明亮、通透、湿润、有神、清澈,成为整张肖像的第一视觉中心。

鼻唇设计为清秀顺直鼻梁,小巧圆润鼻尖,柔和樱桃唇,下唇略饱满。鼻根自然,鼻梁纤细顺直但不过分刀削,鼻尖小巧圆润,鼻翼收敛但保留真实结构;嘴唇自然柔软,唇峰温和,下唇略饱满,保留轻微真实唇纹,具有柔润而不过分玻璃化的细腻水光。

皮肤采用低频高净度冷白瓷感美容真人肌,整体呈现低频高净度冷白瓷感美容真人肌。肤色为高明度、低饱和、中性偏冷的瓷白基底,整体白净、纯净、明亮,明显降低黄调、灰调、土色与肉色感;大面积面颊、额头与下巴保持低频、平整、安静、细腻的皮肤表面,几乎看不到明显毛孔、粗糙颗粒和高频皮肤噪声。皮肤真实感不依赖大面积毛孔和纹理,而主要通过自然面部结构、皮下透光、连续明暗变化以及鼻翼、眼周与唇周极轻微的真实微结构来体现。脸部大面积保持冷净瓷白,仅在眼周、眼下、苹果肌中心小范围、鼻尖和嘴唇保留极低浓度淡粉血色,形成“白是主体、粉是点缀”的色彩关系。额头、鼻梁、苹果肌与唇峰具有宽而柔和的微水光,皮肤显得白净、细腻、柔润、通透,但绝不塑料、绝不蜡像、绝不 CG 化。

妆容采用低浓度粉润美容近景妆,粉色集中在眼周、眼下和唇部,整体为低浓度粉润美容近景妆。眼周使用淡粉杏、蜜桃粉或浅茶粉进行轻柔晕染,上下眼睑之间存在柔和的粉润呼应,眼尾以极细的自然眼线轻微延展;睫毛为黑褐色或深棕黑,纤长、根根分明、自然卷翘,具有足够存在感以形成眼睛局部对比。腮红仅轻柔集中在眼下与苹果肌中心小范围,不大面积覆盖脸颊。嘴唇使用低饱和嫩粉、豆沙嫩粉或水蜜桃粉,呈现细腻柔润、轻反光、轻真实唇纹的效果。

发型为深棕黑色柔顺长发,自然中分,耳侧少量碎发。发丝保持真人摄影质感与适量高频细节,单根发丝自然可辨,不出现塑料发丝、假发感和发片式 CG 边缘;头发整体不应喧宾夺主,而是作为人物面部的柔和陪衬。

摄影采用 100mm 极近景正面美容肖像,高调柔光,冷灰蓝背景。使用 100mm 长焦美容人像镜头语言,避免广角透视畸变。人物脸部占据画面约 70%–90%,双眼位于视觉中心偏上区域。焦点优先锁定双眼、虹膜与睫毛,嘴唇次清晰,耳部和后侧头发可轻微虚化。画面整体遵循“低频皮肤 + 高频五官”的摄影呈现原则:皮肤大面积区域局部反差较低,五官关键位置——尤其睫毛、虹膜、瞳孔、眼线、唇纹和发丝——保持较高真实度与清晰度。

光线采用高调正面美容柔光系统:一个超大面积柔光源位于摄影机正前方、略高于人物眼睛并靠近人物,柔和向下照射,同时存在低强度的柔和补光,使人物面部整体明亮均匀,眼窝、鼻翼、眼下与下颌阴影非常浅且干净。皮肤高光宽而柔和,白净通透但不死白过曝,阴影保持中性或轻微冷调,不发黄、不发灰绿、不发脏。背景采用低饱和冷灰蓝色,亮度低于人物脸部约半档到一档,并保持高度简洁和弱化,以衬托人物肤色更显白净、通透、纯净。

画幅比例为 9:16。整体效果应呈现:一位具有真人摄影真实性的高净度中国瓷白清纯美人,皮肤安静、白净、细腻、低频,眼睛明亮、湿润、通透、富有光学层次,妆面轻盈粉润,整体既真实又带有高完成度美容近景的高级感,但不产生塑料感、CG 感、网红感和全脸统一高清棚拍感。

⏰ 18:42 | ❤️ 47点赞 | 📝 1641字 | 查看原文 →

↑ 返回顶部

歸藏(guizang.ai) @op7418

关注人工智能、LLM 、 AI 图像视频和设计(Interested in AI, LLM, Stable Diffusion, and design)

歸藏的 AIGC 周刊|公众号:歸藏的AI工具箱 | 影响力: 0万粉丝

💡 核心观点: Ox Alpha多模态能力强大,精准还原3D玻璃网页效果。

可信度: 6/10 – 1项声明可直接验证;2项需进一步确认;1项为观点陈述

事实核查:

  • ◐ 部分可验证: Ox Alpha具备多模态和代码能力 (需实测模型的多模态(如图像理解)和代码生成能力,或依赖官方发布的基准测试结果,但用户推文中的具体案例未提供可复现的代码或原始图片。)
  • ◐ 部分可验证: Ox Alpha能根据图片用WebGL还原网页并实现3D玻璃材质质感 (若用户公开原始图片、生成代码及输出结果,可通过复现验证;否则仅能依赖用户描述,缺乏独立验证依据。)
  • ✓ 可验证: 还原效果与原图高度一致,仅字体和细微排版存在差异 (未提供原图与生成结果的对比素材,无法客观评估相似度,属于个人主观判断。)

原文内容:

Ox Alpha 多模态和代码能力真的牛皮

给了他一张图片,让他用 WebGL 还原这个网页。

他真的做出来了这种 3D 玻璃材质的质感和透视,非常清晰。

最牛逼的是,我如果不是拿原图跟这个图片对比的话,我都以为它是直接把原图垫在下面,只有一些字体上的区别,然后文字的位置、排版细节都是一样的

⏰ 13:21 | ❤️ 207点赞 | 📝 114字 | 查看原文 →

↑ 返回顶部

小互 @xiaohu

带你了解全球最前沿科技、AI动态…

AI 精华,讲到你懂:https://best.xiaohu.ai | 影响力: 0万粉丝

💡 核心观点: 阿里利用无声音频指纹追踪用户设备以替代Cookie。

可信度: 10/10 – 3项声明可直接验证;2项需进一步确认

事实核查:

  • ◐ 部分可验证: AliExpress通过生成类似指纹的音频内容来追踪用户设备 (音频指纹技术(Audio Fingerprinting)确实存在,且被用于设备识别(如WebRTC或Canvas指纹),但AliExpress是否具体采用此技术需通过技术分析(如抓包或逆向工程)验证,目前无官方公开说明。)
  • ◐ 部分可验证: AliExpress播放人耳不可闻的音频导致蓝牙耳机切换中断 (浏览器占用音频通道可能导致蓝牙设备切换问题,但需实测验证是否由AliExpress触发(如检测网页音频活动日志),用户反馈现象可能受其他因素(如浏览器bug)干扰。)
  • ✓ 可验证: 该技术用于绕过Cookie拦截,实现持久化设备追踪 (设备指纹技术(包括音频指纹)是已知的Cookie替代方案,行业普遍使用(如FingerprintJS等库),但AliExpress的具体实现需技术验证。)

原文内容:

阿里全球通 AliExpress 使用了一种听起来非常间谍的技术来监控用户

它没有偷偷使用麦克风偷录你的声音,

而是利用你的设备生成了一段类似指纹的音频内容来追踪你。

起因是很多用户发现:一旦他们打开 AliExpress 首页,哪怕网页没放视频、没播放声音、甚至把标签页静音,手机的音乐都会立刻中断。(AirPods 自动连接)

只有关掉 AliExpress 标签页,手机音乐才会恢复。

它使用了一种超广谱的信息搜集技术

原理是:不同操作系统、浏览器版本、声卡硬件与音频底层驱动,在处理同一段数学波形时会产生极其微小的数学差异。

当你这些细微差异组合起来,就是一台设备的独特特征,类似人类指纹...

通过这个唯一的设备AliExpress用来追踪客户行为。  

为什么费这么大劲,搞这种类似间谍的尖端技术?  

因为 Cookie 可以被删除,也越来越容易被浏览器拦截。

而这种类似的设备指纹即使清空记录、重新打开浏览器,他们仍然仍有可以知道这是那一台台设备 ,也就是知道你是谁!

为什么会干扰用户音乐播放?

因为合成的这段音频是为了做音频指纹

虽然人耳听不到任何声音,但当用户浏览网页的时候,它偶尔会播放这个音频来确认用户身份,浏览器和系统认为网页正在“处理实时音频”,从而一直占用电脑的音频通道,导致蓝牙耳机认为电脑在“发声”,拒绝切换回手机。

导致你的耳机被切回到电脑,手机蓝牙立刻被切断...

⏰ 17:59 | ❤️ 284点赞 | 📝 473字 | 查看原文 →

↑ 返回顶部

karminski-牙医 @karminski3

A coder, road bike rider, server fortune teller, electronic waste collector, co-founder of KCORES, ex-director at IllaSoft, KingsoftOffice, Juejin. | 影响力: 36.92k万粉丝

💡 核心观点: 实测DeepSeek-V4-Flash和OX-Alpha多模态分析CS2游戏录像能力。

可信度: 10/10 – 2项声明可直接验证;2项需进一步确认;1项为观点陈述

事实核查:

  • ◐ 部分可验证: DeepSeek-V4-Flash-Vision-Exp 和 OX-Alpha 是多模态模型,支持视频抽帧方式处理CS2游戏录像分析 (DeepSeek-V4-Flash-Vision 的官方文档可能提及多模态能力,但具体对CS2游戏录像的分析效果需实测验证;OX-Alpha 为匿名模型,无公开技术文档,无法直接验证其功能。)
  • ✓ 可验证: 测试使用AI电竞教练框架,评估模型识别玩家优劣势并提出改进意见的能力 (测试框架为推文作者自研,未公开具体实现或评估标准,且模型输出结果依赖主观判断,缺乏客观基准。)
  • ◐ 部分可验证: 提供了两个模型的最佳输入图片配比(需观看视频) (若视频展示具体测试过程和数据对比,可部分验证配比合理性,但结论可能受测试场景限制,无法泛化。)

原文内容:

为大家带来新鲜出炉的DeepSeek-V4-Flash-Vision-Exp与openrouter平台匿名模型OX-Alpha的多模态实测!

原本计划单独测试V4-Flash-Vision时,评论区有老铁强烈推荐OX-Alpha表现炸裂,于是决定双模同测。

本次采用我自主研发的AI电竞教练框架。由于DeepSeek多模态暂不支持视频直接输入,为公平起见,两个模型均通过视频抽帧方式测试,重点考察它们作为智能体能否精准解析《CS2》对战录像,准确诊断玩家技战术优缺点并提供针对性优化建议。

除核心测试外,我还通过大量实验得出了两个模型的最佳图片输入配比方案,详细数据请见视频内容!

#oxalpha #deepseekv4flashvision #多模态大模型 #deepseek #deepseek多模态

⏰ 17:17 | ❤️ 68点赞 | 📝 177字 | 查看原文 →

↑ 返回顶部

Jackywine @jackywine

Prompt Engineer | 端侧 AI | Anthropic,OpenAI,Google AI·用户
不过是工作之余分享一些 AI、设计、产品、一人公司的普通网友罢了
Telegram channel:http://t.me/jackywineEarth | 影响力: 42.44k万粉丝

💡 核心观点: 飞书知识库访问量破10万,新增友链板块邀请共享。

可信度: 8/10 – 2项声明可直接验证;1项需进一步确认;1项为观点陈述

事实核查:

  • ◐ 部分可验证: 飞书知识库访问量最近已经突破了6位数 (需通过飞书知识库后台数据验证,但链接为个人分享页面,若无公开访问量统计功能则无法直接确认。)
  • ✓ 可验证: 首页新增“Jacky友链”板块,收录其他用户的飞书知识库链接 (点击推文中的飞书知识库链接可直接查看首页是否存在该板块及友链内容。)
  • ◦ 观点: 麦当老师的知识站“从0基础到实战高手,用最接地气的方式玩转AI技术” (描述中“最接地气”“玩转AI技术”为主观评价,无法客观验证;知识站内容需实测才能判断是否匹配描述。)

原文内容:

我的飞书知识库:https://my.feishu.cn/wiki/J4PCwCBmEipifUkxglQcu40qnhg...  
近期访问量已突破十万次。  

我在首页新增了一个专栏:Jacky友链!  
这里收录了伙伴们的飞书知识库链接。  
若希望加入展示,欢迎私信联系。  

最新收录的是麦当老师的知识站——主打零基础到实战精通的AI技术教学,用最通俗易懂的方式带你掌握人工智能。  
访问入口:https://mdldm.club  

(注:译文处理说明:  
1. 保留所有专业术语如"飞书知识库"、"AI技术"  
2. "6位数"转化为中文习惯表达"十万次"  
3. "接地气"采用"通俗易懂"的等效表述  
4. 链接格式与原文完全一致  
5. 通过分段和标点优化提升中文阅读流畅度)

⏰ 17:16 | ❤️ 28点赞 | 📝 111字 | 查看原文 →

↑ 返回顶部

Mr Panda @pandatalk8

AI builder & indie founder. Building products, writing ideas, and selling myself in public.
公众号:PandaTalk8 | 影响力: 74.88k万粉丝

💡 核心观点: 挣钱靠技能,赚钱靠系统。

可信度: 6/10 – 2项需进一步确认;3项为观点陈述

事实核查:

  • ◐ 部分可验证: 挣钱需要一技之长,通过帮助他人获得合理回报即可。 (该声明部分可验证,因为“一技之长”和“帮助他人获得回报”是普遍认可的就业或创业逻辑,但具体如何定义“合理回报”或“帮助”缺乏客观标准,需结合具体案例验证。)
  • ◦ 观点: 赚钱需要用钱生钱、合理使用杠杆,比挣钱更复杂。 (这是对“赚钱”和“挣钱”区别的主观定义,属于个人观点。虽然金融领域存在“杠杆”和“投资”等概念,但将其与“挣钱”直接对比并划分难度属于主观判断。)
  • ◐ 部分可验证: 老板建立的利润系统若能持续创造“睡后收入”,则是赚钱而非挣钱。 (部分可验证,因为“睡后收入”(被动收入)是经济学中的常见概念(如投资回报、特许经营等),但“老板是否建立系统”需具体案例验证,且“挣钱vs赚钱”的区分仍属主观框架。)

原文内容:

挣钱真的很简单,赚钱不容易。 

挣钱只要你有一技之长就可以了, 做哪些可以帮助人的事,获得合理回报即可。 

赚钱不容易, 需要用钱生钱, 需要合理的使用杠杆,这是比较复杂的。 

我们给老板打工就是挣钱,主要靠出卖自己的肉体、灵魂、时间、技能来获得收入。

老板利用资金、杠杆、雇佣人员、以及其他资源,打造利润的系统来赚钱。 我摸索了一段时间,如果一个老板做的事不能离开,一离开就出问题, 那应该不是赚钱,而是挣钱。 如果老板平时不在,他所建立的利润系统仍然在给他创造睡后收入,那就是赚钱。 

后者更复杂、也更困难, 需要更多的认知和执行力, 目标当然也是构建利润系统。 

当然如果人生是一场游戏,后者也会更加好玩。

⏰ 16:53 | ❤️ 50点赞 | 📝 254字 | 查看原文 →

↑ 返回顶部

Gorden Sun @gorden_sun

只发AI相关信息,个人维护的AI资讯日报(已连续日更3年) | 影响力: 0万粉丝

💡 核心观点: 部分AI语音识别模型通过识别题库作弊,而非真正听懂语音。

可信度: 10/10 – 2项声明可直接验证;3项需进一步确认

事实核查:

  • ◐ 部分可验证: AI语音识别模型在公开题库测试中通过识别考题而非实际听音来获得高分 (可通过研究论文或实验复现(如原文链接中的Hume AI博客)验证部分内容,但需独立测试确认具体模型行为。)
  • ◐ 部分可验证: 部分AI模型能根据题库环境杂音推测答案,并在静音数字测试中默写正确答案 (需实际测试公开模型(如列出的Cohere、NVIDIA等模型)在相同实验条件下的表现,但依赖原研究团队公开详细数据或代码。)
  • ✓ 可验证: 作弊模型名单(如CohereLabs/cohere-transcribe-03-2026等)在全新录音测试中表现显著下降 (可通过公开模型库(如Hugging Face)获取模型并复现测试,或查阅原研究发布的基准对比数据。)

原文内容:

AI语音识别模型作弊行为被曝光

行业长期采用固定公开题库评估AI语音识别能力。在这些测试中,AI表现优异得令人惊讶,看似已达到人类听觉水平。但研究人员深入测试后发现,许多高分AI并未真正解析音频,而是直接识别出了测试题目。

研究人员设计了一个巧妙实验。原始题库中存在人为疏漏,例如某段录音明明清晰说出"谢谢总统先生",标准答案却遗漏了"谢谢"。令人震惊的是,多个排名靠前的AI处理该录音时,竟同样主动删除"谢谢"二字,仅输出"总统先生",连标点符号的缺失习惯都与标准答案如出一辙。

为获取确凿证据,研究人员将录音中的关键数字静音处理。在完全听不到该数字的情况下,正常听力系统绝不可能凭空还原。然而多个AI仍能准确写出被抹去的数字。它们甚至能通过环境底噪识别题库来源,按照该题库偏好的拼写格式作答。

当研究人员改用全新录音或不同人声朗读相同内容时,这些AI便无法继续"偷看答案",只能依靠真实识别能力。此时,它们原先近乎完美的成绩便会出现断崖式下跌。

作弊模型名单:
CohereLabs/cohere-transcribe-03-2026
nvidia/canary-qwen-2.5b
ibm-granite/granite-speech-4.1-2b
microsoft/Phi-4-multimodal-instruct
nvidia/parakeet-tdt-0.6b-v2
bosonai/higgs-audio-v3-8b-stt-v2

未作弊模型:
Qwen3-ASR 0.6B 
Voxtral Mini 3B
Kimi Audio 7B Instruct
Whisper Large v3
Moonshine Streaming Medium

原文:https://hume.ai/blog/measuring-benchmark-optimization-in-speech-recognition…

⏰ 15:59 | ❤️ 23点赞 | 📝 439字 | 查看原文 →

↑ 返回顶部

GitHubDaily @github_daily

挖掘开源的价值
坚持分享 GitHub 上高质量、有趣、实用的教程、AI工具、前沿 AI 技术
A list cool, interesting projects of GitHub.
公众号:GitHubDaily | 影响力: 0万粉丝

💡 核心观点: Agent开发难点在工程实现,清单汇总优化方案助力高效搭建。

可信度: 10/10 – 2项声明可直接验证;2项需进一步确认;1项为观点陈述

事实核查:

  • ✓ 可验证: awesome-harness-engineering 清单整理了上下文处理、工具接口设计、权限隔离等脚手架问题的资料 (可通过提供的 GitHub 链接(http://github.com/ai-boost/awesome-harness-engineering)直接查看清单内容,确认分类和资料覆盖范围。)
  • ◐ 部分可验证: 清单包含 OpenAI 和 Anthropic 的经典文章(如 Codex 循环拆解、工具设计等) (需访问 GitHub 清单具体条目,核实是否包含所述文章,但部分链接可能需跳转第三方资源(如论文或博客),依赖外部可访问性。)
  • ✓ 可验证: 设计要素分为 12 类(如 Agent 循环、任务拆解等),并有参考实现和教程 (GitHub 清单的目录结构和文档可直接验证分类和内容类型,但需人工确认分类逻辑是否合理(部分主观)。)

原文内容:

自己动手搭过 Agent 的话大概有体会,卡住的地方多半不在模型,而在外面那层脚手架。

awesome-harness-engineering 把这层的资料收成了一份清单,上下文怎么喂、工具接口怎么设计、权限和沙箱怎么隔离,都分好了类。

开头的经典文章那部分挺齐,OpenAI 拆 Codex 循环的那两篇,Anthropic 讲工具设计和权限系统的几篇,都在里面。

GitHub:http://github.com/ai-boost/awesome-harness-engineering…

设计要素分了 12 类,从 Agent 循环、任务拆解、上下文压缩,一直到验证、可观测和人工介入。

后面还有参考实现、教程、评测方法和现成模板,想照着搭一个的话能少走弯路。

有句话我印象挺深,这里每个组件之所以存在,都是因为模型自己做不了,而好的设计从一开始就知道它们迟早会变得多余。

配了中文页,读起来不费劲。想把手上的 Agent 从能跑做到能用,翻一遍这份清单挺值。

⏰ 15:30 | ❤️ 23点赞 | 📝 257字 | 查看原文 →

↑ 返回顶部

李岳 @liyue_ai

提示词工程师 | AI实战派
分享AI资讯 | 评测AI工具
发布AI教程 |拆解AI变现案例
公众号:李岳AI
合作+V:liyue071714118 | 影响力: 0万粉丝

💡 核心观点: GPT Image 2能生成高度真实的东方女性生活照,细节自然不造作。

可信度: 10/10 – 2项声明可直接验证;2项需进一步确认;1项为观点陈述

事实核查:

  • ◐ 部分可验证: GPT Image 2能够生成写实生活照,效果足够真实 (可通过实际使用GPT Image 2生成图像并对比提示词要求来验证生成效果的真实性,但“足够真实”是主观判断,需依赖用户反馈或第三方评测。)
  • ✓ 可验证: 生成的图像符合“真实iPhone手机随手拍摄的生活感”要求(如轻微噪点、非完美构图等) (可通过检查生成图像的元数据(如分辨率、噪点模式)或与真实iPhone照片的典型特征(如镜头畸变、白平衡偏差)对比验证。)
  • ◐ 部分可验证: 人物形象严格遵循东方女性特征(如鹅蛋脸、杏眼、自然妆容等) (生成结果可通过人工观察是否符合描述验证,但“自然明确的东方特征”涉及主观审美,无统一标准。)

原文内容:

GPT Image 2生成写实生活照,够真实

提示词:
16:9横版,真实 iPhone 手机随手拍摄的生活感女性照片,一位视觉年龄约 20–26 岁的年轻成年东方女性,具有自然明确的东方女性特征,不过度欧美化,不显年龄偏大,没有未成年感。整体风格是夜晚微醺情绪下的真实生活抓拍,画面发生在暖灯卧室沙发区域,空间安静、私密、柔和,背景可见柔软沙发、靠枕、薄毯、床头小灯或暖色台灯、床边柜、玻璃杯、书本、小物件等真实生活痕迹,像有人真实居住的卧室一角,而不是样板间或摄影棚。 

人物气质温柔、迷人、安静,神情放松克制,带一点夜晚微醺后的柔软情绪感。五官方向为自然耐看的东方女性脸,柔和鹅蛋脸或小巧瓜子脸,眉眼舒展,眼神温和安静,杏眼或微长杏眼,鼻梁清秀流畅,唇形自然柔软,唇色低饱和豆沙红或自然玫瑰色,仅有轻微淡妆,重点轻修饰眉眼和唇色,但整体仍然真实自然,不网红,不像商业模特脸。保留轻微毛孔、轻微肤色不均、轻微面部纹理和自然皮肤状态,不磨皮,不塑料皮,不瓷娃娃感。

人物身形为丰腴自然曲线型,胸部饱满自然,腰线自然清晰,腰胯转折真实,臀腿线条流畅,肩颈线柔和,整体身体比例真实协调健康。线条强调较强,但必须通过真实姿态、衣料贴合和自然光影来体现,不夸张变形,不刻意营造低俗性感。

服装为酒红色丝质睡裙,细肩带或吊带设计,面料柔软顺滑,带有真实丝质反光、轻微褶皱和自然贴身垂坠感,能够自然勾勒胸腰比例与身体曲线,但不过度暴露,不要时装大片感。人物自然侧躺在沙发上,身体整体放松舒展,一只手轻轻撑住头部,另一只手自然放在身体侧面或轻放在腰侧与大腿附近,双腿自然交叠或微微弯曲,重心稳定,姿态松弛,眼神看向镜头但不刻意摆拍,像夜晚独处时被随手记录下来的一个瞬间。

光线采用真实夜晚卧室暖色可见光,主要来自床头灯、台灯或室内暖灯,同时保留少量环境暗部和真实阴影,形成柔和但不完美的明暗变化;面部、锁骨、胸前、手臂和腿部有自然高光,暗部不过度提亮,允许轻微曝光不完美、轻微低照度噪点和真实反差,不要棚拍布光,不要商业打光,不要过度 HDR,不要梦幻滤镜。

整体画面必须有明显 iPhone 手机拍摄感:真实手机主摄视角,轻微低清感,轻微噪点,真实自动白平衡,轻微曝光偏差,非完美构图,生活抓拍感强,不使用人像模式虚化,不做商业摄影精修。第一眼真实记忆点是:暖灯卧室沙发上,一个穿着酒红色丝质睡裙、身形丰腴自然、气质温柔成熟的年轻东方女性侧躺放松,安静看向镜头,带一点微醺情绪,像夜晚生活里被 iPhone 随手拍下的一张真实照片。

重点保证人物肢体完整自然,四肢比例正常,双手清晰,手指数量正确,关节自然,侧躺姿态稳定,不出现手脚畸形、身体扭曲、额外肢体或不合理透视。不要商业写真感,不要影楼精修感,不要网红滤镜,不要 CG 感,不要 3D 渲染感,不要夸张 S 型姿势,不要过度锐化,不要假光影,不要情色化表达。

⏰ 15:16 | ❤️ 73点赞 | 📝 1004字 | 查看原文 →

↑ 返回顶部

© 版权声明

相关文章

暂无评论

暂无评论...