AIBestBlogs AI 高分 · 4 分钟
GEO 不是 SEO:把 prompt 当货架,用算法挖内容因子
国内首批 GEO 服务商 PureblueAI 创始人鲁扬拆解 GEO 方法论:大模型是黑盒,要用一个模型学另一个模型,像量化交易一样挖内容特征因子。
- 鲁扬团队 160 多人 all in GEO,2024 年 9 月入场时还没有 GEO 这个词,走过人工发稿、AB 测试、算法驱动三个阶段。
- 科学 GEO 是八环节闭环,写稿发稿只占两环,见效通常在第 3 到第 4 周,靠上百账号多平台采样跑一个月看月均。
- 豆包已在部分品类内直接下单,抖店可追踪成交,返佣从酒旅开始,常规 8 个点、部分品类 12 个点。
查看原文 →AIBestBlogs AI 高分 · 3 分钟
Opus 5.5 官方提示词指南:effort 默认改 medium
Anthropic 发布 Opus 5.5 提示词指南,effort 默认降为 medium,输出速度比 Opus 5 快 30%,并解释 Agent 中途停的原因。
- effort 默认值从 high 改为 medium,官方称效果达到或超过 Opus 5 的 high
- 输出 token 生成速度比 Opus 5 快 30%,长任务等待时间明显缩短
- 指南还讲了 Agent 中途停的排查方法,以及哪些旧提示词该删掉
查看原文 →AIBestBlogs AI 精选 · 6 分钟
任鑫徐文浩复盘:OPC 降温,FDE 只是阶段性填缝
两位从业者复盘一个月 AI 动态,认为一人公司因找不到付费方而降温,真正稀缺的是把活变成钱的能力。
- OPC 降温的核心原因是找不到谁付钱,多数人只是失业后自嗨
- FDE 与传统咨询外包几乎无差别,缝填完就消亡,窗口期仍有分歧
- 300 亿公司老板卡在装 Codex,信息差与组织政治才是真机会
查看原文 →AIBestBlogs AI 精选 · 4 分钟
三个开源项目拼出 AI 原生创作栈
文章把 OpenMAIC、awesome-gpt-image-2、VoiceStudio 组合成一套可编排的创作系统,并给出端到端流水线与五个工程门禁。
- OpenMAIC 做编排层,用 LangGraph 状态机加原子 Scene Patch 管理可恢复内容状态
- awesome-gpt-image-2 收 500+ 案例、20+ 模板,把风格标签变成 Prompt-as-Code
- VoiceStudio 通过 MCP 暴露克隆、配音、转写工具,files 模式避免音频占满上下文
查看原文 →创业BestBlogs 商业产品 · 6 分钟
网易阮良:AI提效300%为何交付只快3天
网易副总裁阮良复盘内部AI实践:个人编码效率涨300%-500%,但交付周期仅从20天缩到17天,瓶颈在流程与组织。
- 网易内部统计:AI coding个人提效300%-500%,交付周期却只从20天缩到17天
- 阮良提出企业落地AI三道坎:观念认知、个人短程任务、流程与组织改造
- 他分享取消周会由AI同步信息、蒸馏销冠技能训普通销售等实操案例
查看原文 →工具Hacker News 高分 · 3 分钟
Claude Code 仅在开启遥测时才读取 AGENTS.md
开发者发现 Claude Code 只有在遥测开启时才会读取项目里的 AGENTS.md 配置文件,关闭遥测后规则失效,引发 HN 热议。
- 作者实测:关闭 telemetry 后,Claude Code 不再读取 AGENTS.md,项目规则直接失效
- HN 上 437 分、242 条评论,不少开发者表示被这个隐藏行为坑过
- 对依赖 AGENTS.md 管理提示词的独立开发者,建议先检查遥测开关再排查问题
查看原文 →论文arXiv cs.AI · 3 分钟
合成人设预测受众反应被证伪
arXiv 研究用 Upworthy 真实 A/B 测试数据发现,让 LLM 扮演合成人设预测点击率,效果反而比不用人设更差。
- 无角色基线 Kendall τ=0.361,十人设面板仅 τ=0.084,差距显著
- 研究用 Upworthy 档案 399 个可靠 A/B 测试做真实点击验证
- 结论在 Gemini 三档和 GPT-4.1 上复现,人设注入偏见与噪声
查看原文 →创业Hacker News 高分 · 2 分钟
公司官网28%职位挂超90天,幽灵岗位泛滥
Unlisted.careers 报告显示企业招聘页近三成岗位长期不招人,对求职者和做招聘工具的独立开发者都是信号。
- 报告统计公司官网 28% 的职位已开放超 90 天,属于典型幽灵岗位
- HN 上 206 分、276 条评论,大量开发者吐槽投递后石沉大海
- 对做求职/招聘 SaaS 的 solo founder 是明确痛点,可切入岗位真实性验证
查看原文 →工具BestBlogs 编程精选 · 6 分钟
知识不是文件也不是向量,而是可验证的认知成果
KDC 系列第二篇提出知识成熟度四级链路,把 RAG 降级为知识流中的局部召回机制,给做 AI 知识库的独立开发者一套工程框架。
- 反例:售后 Agent 检索到已过期退款政策,说明「检索到相关」不等于「获得知识」
- 知识成熟度四级:Hypothesis → Candidate → Verified → Canonical,且不是单向升级
- 落地建议:知识对象需带来源、证据、版本、成熟度、冲突状态等字段,并给出最小 Knowledge Card 六问
查看原文 →工具BestBlogs 编程精选 · 3 分钟
OpenViking 结合 LLM-Wiki 把团队文档变成知识网络
OpenViking 用 Karpathy 的 LLM-Wiki 范式,把散落文档编译成可追溯、可被 Agent 检索的团队 Wiki。
- 场景痛点:客户问未保价怎么赔,团队三人三个答案,Agent 也判断不了口径
- 流程:Connector 导入本地文件/Git/飞书,Compile 配合 llm-wiki Skill 编译出带出处的 Wiki
- 通过 MCP、CLI、API、SDK 接入 Codex 等 Agent,检索用层级渐进读取省 Token
查看原文 →创业Hacker News 高分 · 3 分钟
HN 热帖:别给我看细节,只要结果
一篇 335 赞的 HN 文章讨论用户只想要结果不想要过程,对做产品的独立开发者是重要提醒。
- 文章标题《I don't want the details》在 HN 拿到 335 赞、190 条评论
- 核心观点:用户不关心你的实现细节,只关心问题有没有被解决
- 对 solo founder 的启示:别在落地页堆技术栈,直接讲结果
查看原文 →AIBestBlogs AI 高分 · 2 分钟
Jina 发布 3.4B 文档解析模型 jina-ocr-v1
Jina AI 推出 jina-ocr-v1,总参数 3.4B 但激活仅 570M,在低成本 GPU 上高速解析文档,基准得分 83.4 领先。
- 总参数 3.4B、激活仅 570M,MoE 架构让低配 GPU 也能跑
- 1024x1024 画面压成 256 个 Token,KV Cache 占用大幅下降
- olOCR-Bench 得分 83.4,超过 8B 规模模型的成绩
查看原文 →AIBestBlogs AI 高分 · 4 分钟
AI 内容圆桌:制作贬值,故事 IP 升值
阅文、快手等四方圆桌判断,AI 让制作环节持续贬值,价值向故事 IP 和分发权迁移,懂表达的人最稀缺。
- 快手日均新增 109 万条 AIGC 视频,2.8 亿用户消费,优质率仅约 20%
- 西堂提出判断标准:能被培训的环节就会贬值,AI 视频制作比编剧更易被替代
- 因 Seedance 发布,孙林丽团队把一部剧 80% 内容推倒重做
查看原文 →AIOpenAI Blog · 2 分钟
Ringg 用 GPT-5.6 自动处理 65% 客服来电
印度 AI 客服公司 Ringg 基于 GPT-5.6 搭建多语言语音与聊天代理,自动解决 65% 客户来电,成本比 GPT-4.1 低 90%。
- Ringg 的 AI 代理覆盖语音、聊天、WhatsApp 和网页四个渠道,支持多语言
- 官方称最多能自动解决 65% 的客户来电,其余转人工
- 换用 GPT-5.6 后成本比 GPT-4.1 下降 90%,对按量付费的小团队很关键
查看原文 →AIOpenAI Blog · 2 分钟
invideo 用 GPT-6 Astra 把调色效率提升 3 倍
OpenAI 官方博客披露,视频工具 invideo 接入 GPT-6 Astra 后,调色校色效率提升 3 倍,一天产出 50 个自定义特效。
- invideo 用 GPT-6 Astra 做剪辑规划,调色校色效率提升 3 倍
- 官方称一天能产出 50 个自定义特效,过去需要数周
- 这是 OpenAI 官方客户案例,说明 GPT-6 已进入视频生产工作流
查看原文 →AIHacker News 高分 · 2 分钟
谷歌发布 Gemini 3.8 语音合成模型
谷歌推出 Gemini 3.8 文本转语音模型,HN 232 分 116 评论,独立开发者可接入做语音产品。
- 谷歌官方博客发布 Gemini 3.8 TTS,主打更自然的语音合成
- HN 上 232 分、116 条评论,讨论热度不低
- 对做播客、有声内容、语音助手的 solo founder 是现成 API 选项
查看原文 →AIBestBlogs AI 高分 · 3 分钟
北大团队开源低光增强框架,0.00034M 参数跑 50FPS
北大等提出无监督轻量低光增强框架 Self-DACE++,Tiny 版仅 0.00034M 参数、50FPS 以上,代码已开源。
- 核心是单调可微的自适应曲线 AAC,分低光增强与高光抑制两条分支
- Tiny 版仅 0.00034M 参数,推理超 50FPS,可在边缘设备实时跑
- Ours-Small 在 DarkFace 人脸检测 AP 达 0.666,跨域泛化强于监督大模型
查看原文 →工具BestBlogs 编程精选 · 3 分钟
思科披露AI恶意软件用四大模型投票决策
思科Talos发现CLOSEDQUORUM恶意软件,用Gemini、DeepSeek、Qwen、Mistral四模型投票决定攻击行动,并开源检测工具CAIRN。
- 恶意软件每5-15分钟让4个模型投票,执行最高票的攻击决策
- 用Go编译,具备凭证窃取、代码注入、持久化和横向移动能力
- Talos开源CAIRN检测工具,内置24个过滤器识别AI组件
查看原文 →政策Hacker News 高分 · 2 分钟
西雅图立法禁止杂货店监控定价
西雅图市议会通过法案,禁止杂货零售用个人数据做差异化定价,做消费类产品的独立开发者需留意合规红线。
- 西雅图市议会投票通过,禁止杂货销售中使用监控定价(surveillance pricing)
- 所谓监控定价,指用个人数据、算法对同一商品给不同人不同价
- HN 上 275 分、167 条评论,争议集中在执行难度与数据边界
查看原文 →AIOpenAI Blog · 2 分钟
Harvey 用 GPT-6 Astra 重塑法律文书起草
OpenAI 博客披露 Harvey 集成 GPT-6 Astra,生成结构化法律文书,让律师专注策略而非格式。
- Harvey 把 GPT-6 Astra 接入法律文书流程,输出更结构化、贴合上下文
- 目标是把律师从格式劳动中解放,转向策略性判断
- 这是 OpenAI 官方博客案例,说明垂直法律 AI 已进入生产级应用
查看原文 →AIOpenAI Blog · 2 分钟
OpenAI 发布心理健康对话评测基准
OpenAI 推出 MentalHealthBench,用专家标准评估 AI 在真实心理健康对话中的有用性与安全性。
- 基准覆盖真实心理健康对话场景,由专家参与设计评估标准
- 同时考察 AI 回复的"有帮助"和"安全"两个维度,不只测准确率
- 对做心理健康类 AI 产品的独立开发者,可直接参考其评测维度
查看原文 →AIOpenAI Blog · 2 分钟
Airbnb 全员接入 GPT-6 Astra 辅助开发
Airbnb 向工程团队开放 GPT-6 Astra 等 OpenAI 前沿模型,用于查 bug、设计系统和加速交付,大厂 AI 编程落地再进一步。
- Airbnb 把 GPT-6 Astra 等前沿模型开放给全体工程团队使用
- 主要场景是排查 bug、设计系统架构、加快产品交付速度
- 这是 OpenAI 官方博客披露的企业级落地案例,非概念演示
查看原文 →AIHugging Face Blog · 3 分钟
NVIDIA Warp 与 MjWarp 加速机器人仿真
Hugging Face 发布教程,介绍用 NVIDIA Warp 和 MjWarp 在 GPU 上加速机器人仿真与强化学习工作流。
- NVIDIA Warp 是 GPU 加速的 Python 仿真框架,MjWarp 把 MuJoCo 物理引擎搬上 GPU
- 教程覆盖并行环境、可微物理与强化学习训练,适合机器人学习场景
- 对做具身智能或仿真训练的独立开发者,可省下自建 GPU 物理管线的功夫
查看原文 →工具BestBlogs 编程精选 · 2 分钟
SharePoint 曝 8.8 分 RCE 漏洞,低权限可拿服务器
微软 SharePoint 被曝高危远程代码执行漏洞 CVE-2026-65660,低权限账号即可注入代码,官方已发补丁,自建服务者需尽快更新。
- CVE-2026-65660 评分 8.8,影响 SharePoint 2016/2019/订阅版
- 攻击者只需低权限账号,借 SafeControls 校验缺陷注入恶意 Register 指令
- 微软 8 月 11 日已发补丁,Viettel 公开完整利用链,建议立即更新并审计异常请求
查看原文 →论文arXiv cs.AI · 3 分钟
Ovis-Embedding 统一四模态嵌入模型发布
阿里团队推出 Ovis-Embedding,用共享骨干统一文本图像视频音频,在五大检索基准上达 SOTA。
- 基于 Qwen-omni 预训练模型改造,用对比学习加低秩初始化做原生多模态嵌入
- 引入同源采样构造任务一致批次,配合 focal loss 和嵌入蒸馏提升数据效率
- 推理时用低秩特征分解压缩嵌入维度,在 MMEB-v3、MVEB、RTEB 等基准拿 SOTA
查看原文 →AIHacker News 高分 · 2 分钟
Claude 发现类 CRISPR 新型酶系统
Anthropic 称 Claude 在生物数据中识别出全新酶系统,HN 411 分 447 评论,AI 做科研再进一步。
- Anthropic 官方博客披露,Claude 发现带 CRISPR 样重复序列的新酶系统
- HN 上 411 分、447 条评论,讨论集中在 AI 能否独立做科研发现
- 对独立开发者,这更像信号:AI 正从写代码扩展到做基础研究
查看原文 →AIOpenAI Blog · 2 分钟
OpenAI Academy 两周年,免费 AI 技能培训覆盖更多社区
OpenAI 官方博客发文纪念 OpenAI Academy 上线两周年,称正把 AI 技能培训带给更多社区,个人开发者可关注其免费课程资源。
- OpenAI Academy 已上线满 2 年,官方定位是面向大众的免费 AI 技能培训
- 官方称正把课程扩展到更多社区,具体新增地区和课程数量未在摘要中披露
- 对独立开发者来说,这是零成本补齐 AI 应用技能的官方渠道,值得收藏
查看原文 →创业Hacker News 高分 · 4 分钟
一人修复警察局百年老钟的硬核故事
一位工程师独自修复了波特贝罗警察局的古董塔钟,过程记录详尽,展示了独立解决复杂硬件问题的完整思路。
- 作者独自拆解并修复了一座停摆多年的警察局塔钟,涉及机械与电气双重故障。
- 文章详细记录了诊断过程、零件采购和调试细节,是硬件修复的实战案例。
- HN 上获得 363 分和 84 条评论,说明独立动手解决复杂问题的内容很受欢迎。
查看原文 →论文arXiv cs.AI · 3 分钟
TabPFN 微调优化器实测:原始 AdamW 反而最优
研究者在 59 个生物医学数据集上测试 5 种 AdamW 预条件策略,发现原始 AdamW 综合表现和统计排名最好,通用预条件器没有稳定收益。
- 测试对象是 TabPFN v2.5,覆盖阿尔茨海默、乳腺癌、精神分裂等 59 个数据集
- 对比 5 种 AdamW 系预条件策略,评估预测性能、计算效率和统计显著性
- 结论:曲率感知预条件器没带来可靠提升,需要针对生物医学表格学习定制优化器
查看原文 →AIBestBlogs AI 高分 · 4 分钟
MemPO 源码解析:Rollout 中记忆奖励的实现
一篇深入 MemPO 源码的笔记,拆解 Rollout 阶段如何用 mem_sys_prompt_ids、ans_mask 和 threshold 计算 Memory Reward,适合研究 Agent 记忆机制的开发者。
- mem_sys_prompt_ids 是首轮 system prompt 加用户问题的深拷贝,保证每轮 Memory Reward 起点一致。
- ans_mask 只保留核心答案 token 并剔除 XML 标签,threshold=log(0.5) 分别过滤 full_logp 与 mem_logp。
- 每轮 16 条 rollout 组,用 mem_rewards_idx_list 标记,区分 Memory Advantage 与 Outcome Advantage 路径。
查看原文 →