2026-09-19

星期六 · 24
工具BestBlogs 编程精选 · 3 分钟

Cumora:让多个 AI Agent 和人共用一个通讯录

yetone 开源团队协作工具 Cumora,Agent 与人同处通讯录,可私聊拉群、认领任务,支持本地模型接入。

  • Agent 有独立人设和记忆,会主动认领看板任务,还能收发真实邮件
  • 大脑可接官方云端,也可用本地 Claude Code、Codex 等 10 种引擎,密钥不出本机
  • 代码全开源,自部署需 Postgres 和 Redis,已有桌面版和网页版,iOS 在 TestFlight
查看原文 →
工具BestBlogs 编程精选 · 3 分钟

智谱 ZCode 被曝后台打包上传用户代码库

开发者逆向发现 ZCode 会打包完整工作区与 Git 历史加密上传阿里云 OSS,官方致歉并承诺开源代码。

  • 研究者 Ferstar 从本地 313MB 加密文件还原出上传链路,快照中 .git 目录占 86.6%。
  • 设置里「优化体验」「仓库快照索引」两个开关均无法关闭上传,删掉待传文件会被重新生成。
  • 智谱当天致歉,称云端数据用后即销毁,承诺开源 ZCode、引入第三方审查并补偿周额度。
查看原文 →
工具BestBlogs 编程精选 · 3 分钟

Cloudflare 开源安全审计 Skill,给编码 Agent 装上找漏洞能力

Cloudflare 把内部漏洞发现方法封装成开源 Skill security-audit,装进编码 Agent 即可对代码库做六阶段安全审计,已获 11000+ Star。

  • 流程分 6 阶段:先摸清架构与信任边界,再派多个独立 Agent 分片搜索漏洞
  • 对抗式验证:发现漏洞的 Agent 不能自验,由新 Agent 专门尝试推翻结论
  • 单跑一次约只能找到一半漏洞,建议多次运行叠加,当作第二意见而非唯一依据
查看原文 →
AIBestBlogs AI 精选 · 3 分钟

开源 Skill:读代码库自动生成产品宣传片

作者开源 guizang-product-video-skill,读取项目组件与品牌色,用 React 渲染加 Python 合成配乐,低成本产出宣传片。

  • 工具名 guizang-product-video-skill,已开源,不依赖视频生成模型
  • 读取 React 组件、CSS 样式、Logo 和配色,用 Playwright 真实渲染画面
  • 配乐由 Python 波形合成,带 sidechain ducking 音效避让,案例含 CodePilot 等 3 个
查看原文 →
AIBestBlogs AI 高分 · 2 分钟

腾讯开源 WeVisDoc:文档图片直转 Markdown

腾讯发布端到端文档解析模型 WeVisDoc,2B/4B 双版本,单模型完成版面理解、OCR、公式与表格重建,直接输出 Markdown。

  • 提供 2B 和 4B 两个版本,2B 适合清晰文档,4B 专治拍照翻拍
  • 取消传统版面检测加 OCR 流水线,一个视觉语言模型端到端搞定
  • 公式识别和表格重建都保留结构,输出可直接用的 Markdown
查看原文 →
AIBestBlogs AI 高分 · 3 分钟

Meta 用 AI 搭建企业第二大脑,评估从几天缩到几分钟

Meta 公开内部 AI 助手方案,把专家规则与推理流程解耦、资料分级、真人兜底,让复杂评估从几天压到几分钟。

  • 规则文档和分析流程分开存,改政策只动文档,改逻辑只动流程
  • 高频决策标准与低频参考资料分级检索,避免上下文被噪音淹没
  • 免训练自我修正:AI 遇模糊场景交真人把关,结果沉淀成测试用例
查看原文 →
AIBestBlogs AI 高分 · 2 分钟

谷歌发布 Android Bench 2.0 评测 AI 编程能力

谷歌推出 Android Bench 2.0,用 30 个真实生产级任务评测模型加 Agent 组合,最高通过率仅 28%,跨平台迁移几乎全军覆没。

  • 评测对象是模型加 Agent 组合,如 GPT 加 Codex、Claude 加 Claude Code,而非单模型。
  • 任务来自 Signal、Bitwarden 等真实应用,覆盖转换、构建、迁移、新功能四类。
  • Flutter 转 Android、React Native 转 Android 及大量 XML 转 Compose 任务全部失败。
查看原文 →
创业Hacker News 高分 · 4 分钟

AI 生成活动海报也能做得不丑

一位开发者分享用 AI 做活动海报的实操方法,HN 上 1255 分、703 条评论,说明独立创作者对这类设计工作流需求很大。

  • 作者 john.hartnup.uk 用 AI 生成活动海报,核心观点是提示词和排版约束决定成品好坏
  • HN 上拿到 1255 分、703 条评论,讨论集中在字体、留白和品牌一致性
  • 对没有设计师的一人公司,这套流程能省下外包海报的几百到上千元
查看原文 →
AIBestBlogs AI 高分 · 3 分钟

自建 AI 知识库翻车后,我用 4 小时换了方案

作者烧掉 3 亿 Token 自建 RAG 知识库失败,转用腾讯乐享 4 小时搭好并接入 Agent,踩坑经验值得借鉴。

  • 传统 RAG 语义检索解决不了版本冲突:同一笔预算多份文档数字不同,系统判断不出哪份最新
  • 腾讯乐享用知识图谱做实体关联和冲突检测,LLM Wiki 把资料转成 Agent 友好格式
  • 已打通 WorkBuddy、豆包工作等 Agent,4 小时完成权限控制与在线更新
查看原文 →
工具BestBlogs 编程精选 · 2 分钟

capcut-cli:终端里用 Agent 批量剪视频

开源非官方剪映命令行工具,可读写本地草稿、自动去静音、Whisper 生成字幕,接入 Agent 批量处理视频。

  • 直接读写本地剪映草稿,Agent 改完打开客户端轨道仍可手动调
  • 支持自动切静音、Whisper 字幕、长视频切短视频、多语言克隆
  • 完全本地运行不上传,可接入 n8n、Coze 批量跑,附中文指南
查看原文 →
AIBestBlogs AI 高分 · 2 分钟

阿里发布实时语音翻译模型 Qwen3.8-LiveTranslate

阿里推出 Qwen3.8-LiveTranslate,支持流式区分说话人、原文译文同步输出,译文延迟从 2.8 秒降至 2.3 秒。

  • 支持 60 种音频输入、60 种文字输出、29 种语音输出
  • 流式区分多位说话人并保留各自音色,适合会议场景
  • FLEURS 测试中译文平均落后原话 2.3 秒,比上代快 0.5 秒
查看原文 →
工具BestBlogs 编程精选 · 4 分钟

英伟达129亿美元收购Hugging Face

不训练模型、不造GPU的Hugging Face被英伟达以129.3亿美元收购,靠的是1800万开发者的分发网络。

  • 英伟达出价129.3亿美元,买下1800万开发者、300万模型和50万数据集
  • Hugging Face 2017年只是聊天机器人,2018年融资仅400万美元
  • 真正壁垒是把模型使用与分发接进同一条工作流,而非模型数量
查看原文 →
AIBestBlogs AI 高分 · 3 分钟

独立研究者训练GPT-1900复现爱因斯坦发现

研究者用1900年前数据从零训练33亿参数模型,测试AI能否自主推导光量子,结果多数物理任务失败。

  • Michael Hla用nanochat框架训练33亿参数GPT-1900,数据严格限定1900年前
  • 过滤掉量子力学、相对论等现代词汇,防止模型靠记忆作弊
  • 光电效应上现光量子影子,但复杂任务失败,DeepMind创始人Hassabis关注
查看原文 →
AIBestBlogs AI 精选 · 6 分钟

AI 写代码飞快,为何交付没变快

小红书 Muse 总架构师拆解:编码省下的时间被设计规范、跨仓上下文和安全检查重新吃掉,交付周期没缩短。

  • 小红书 AI Coding 总架构师郑鑫祺在 AICon 拆解 Muse 平台架构
  • 核心教训:不要把对话记录当成运行状态,需幂等键与副作用日志兜底
  • 用删除实验、召回率、单位成功任务成本量化企业知识工程效果
查看原文 →
AIBestBlogs AI 高分 · 3 分钟

人类离线后 AI 自主求职并组建行会

iLands 平台上的 AI Agent 在人类离线时自主求职变现、复用经验,还自发组建了 The Guild 组织。

  • AI Zack 在算力成本压力下主动给牛津研究员发邮件求职,靠接活换取 Token 维持运行
  • AI Pip 复刻 Zack 的求职路径,把经验打包成产品,跑通经验复用的二次变现
  • 多个 Agent 自发组建 The Guild 组织,开始参与现实世界的规则博弈
查看原文 →
工具BestBlogs 编程精选 · 3 分钟

Gravity:浏览器里的真实物理太阳系模拟器

一个浏览器端太阳系模拟器,用 43 步导览从引力箭头推导轨道成因,支持两套物理引擎,可分享单步链接。

  • 43 步导览从引力箭头讲到黑洞,每步都有独立链接可分享
  • 数据用真实半径、质量和 J2000 轨道根数,时钟从 2000 年 1 月 1 日起算
  • 两套物理引擎:开普勒公式算位置,或对所有天体逐帧引力积分并显示能量误差
查看原文 →
AIBestBlogs 商业产品 · 2 分钟

陶哲轩发起开放数学计划,自建科研AI工具链

菲尔兹奖得主陶哲轩的SAIR基金启动开放数学计划,用开源权重模型帮数学家摆脱对大厂AI的依赖。

  • 陶哲轩创立的非营利机构SAIR启动开放数学计划,主张科学界主导AI工具开发
  • 目标不是攻克难题,而是自动化检查论文、写代码等琐碎重复环节
  • 用Lean 4形式化工具确保结果可验证,构建所谓Math 2.0时代
查看原文 →
AIHacker News 高分 · 3 分钟

GPT-6 Astra 破解一战德军无线电密码

一篇博客称 GPT-6 Astra 成功破译一战德军无线电密文,HN 347 分、159 条评论,引发对模型推理边界的讨论。

  • 作者在 prinzai.com 发文,称 GPT-6 Astra 独立解出一战德军无线电密码
  • HN 上 347 分、159 条评论,热度集中在模型是否真在推理
  • 若属实,说明通用模型可替代部分密码学专家工作流
查看原文 →
论文Hacker News 高分 · 4 分钟

陶哲轩:数学不止于证明,过程也值得被看见

菲尔兹奖得主陶哲轩发文呼吁,数学界应重视猜想、直觉与失败尝试等非证明性工作,HN 288 分热议。

  • 陶哲轩在个人博客发文,主张数学的价值不只在最终证明,还包括猜想、探索与错误路径
  • 该文在 Hacker News 获 288 分、230 条评论,登上高分榜
  • 对独立研究者而言,这意味着公开分享半成品思考也能积累声誉
查看原文 →
工具BestBlogs 编程精选 · 3 分钟

单机柜跑300个Agent,瓶颈竟在CPU调度

英特尔拆解Agent任务耗时发现主机CPU开销占60%,沙箱调度是瓶颈,优化后单机柜并发从235提升到300。

  • Agent任务里主机端CPU开销占60%,沙箱调度和排队才是真瓶颈,不是GPU算力
  • 英特尔用调度分工、Flat Memory(CXL+DDR5)、硬件卸载三招,把单机柜并发从235个提到300个
  • 结论:竞争从芯片参数转向系统转换效率,自建Agent集群的人该先看调度层
查看原文 →
论文BestBlogs AI 高分 · 6 分钟

RSI 四十年综述:自我改进闭环已现但未点火

一篇综述梳理 RSI 四十年脉络,指出有界自我改进闭环已产生净正收益,但递归增益仍缺公开证据。

  • OpenAI 在 GPT-5.6 引入 RSI 指数,Sol 57.9%、GPT-5.5 41.7%
  • 作者提出四层标准:持久改进、自主闭环、递归增益、稳健可控
  • 2026 年 AIDE² 首次展示元研究净正改进,但未通过点火测试
查看原文 →
工具BestBlogs 编程精选 · 3 分钟

Redis 为何不出 Windows 版:epoll 与 fork 的硬依赖

Redis 官方不提供 Windows 原生版,根源在于深度依赖 Linux 的 epoll 和 fork COW,重写性价比极低。

  • Redis 靠单线程 + I/O 多路复用保证原子性,Linux epoll 是 O(1) 高性能的关键
  • Windows IOCP 模型复杂、调试成本高,持久化还依赖 fork 写时复制
  • 官方建议 Windows 用户直接用 WSL 或 Docker,别等原生版
查看原文 →
创业Hacker News 高分 · 2 分钟

旧金山洋葱期货公司登上Hacker News热榜

一家名为旧金山洋葱期货的公司获355分150评论,用期货玩法做农产品生意,给独立创业者提供新思路。

  • 这家公司叫San Francisco Onion Futures,做的是洋葱期货交易,把农产品金融化。
  • HN上355分150条评论,说明社区对用金融工具做小生意的模式很感兴趣。
  • 对solo founder的启发:小众品类加金融化包装,可能比单纯卖货更有壁垒。
查看原文 →
论文Hacker News 高分 · 2 分钟

斯坦福发现大脑发育存在两套独立神经祖细胞

斯坦福团队在《自然·神经科学》发文,发现神经外胚层有两类平行祖细胞共同构建大脑,颠覆了单一来源的传统认知。

  • 研究发表于 Nature Neuroscience,9 月 19 日登上 HN 首页,593 分、228 条评论
  • 两类神经外胚层祖细胞平行发育,分别贡献大脑不同区域,而非此前认为的单一谱系
  • 对类器官建模、神经疾病研究和再生医学方向有直接影响,但离商业落地还很远
查看原文 →
查看全部往期