No Matter How Powerful AI Gets, Engineering Remains the Foundation of Every Project
Exploring why engineering practices, not just AI, are crucial for sustainable project success in the tech industry.
Exploring why engineering practices, not just AI, are crucial for sustainable project success in the tech industry.
An experiment on Linux.do shows Gemini 3 Pro's superior reasoning in a matchmaking quiz, excelling at complex, counter-intuitive social questions.
开发者在Linux.do社区发布开源项目“梵高油画动画生成器”(van-gogh-cinematic-storyboard),这是其继上美影动画风格、乐高大电影风格之后推出的第三个风格化短视频制作skill。项目核心逻辑是:用户输入一个故事,系统先分析故事的“情感基调”,再以梵高的笔触将其渲染成一部动态油画短片,项目已在GitHub上完整开源。作者此前在社区发布的seedance短剧生成项目获得超过2400个star。新项目延续相同的使用模式:下载风格skill和即梦CLI工具后,仅需一句话命令,例如“利用梵高skill制作短视频,故事为孟母三迁”,即可自动完成从故事理解、风格化生图到视频生成的全流程,其中生图与生视频环节由即梦CLI调用完成。该系列skill的技术路径是借助大模型的skill机制,将特定艺术风格的提示词工作流封装为可复用模块,配合CLI视频生成工具实现自动化生产。项目遵循社区开源推广规范,完整开源、无未开源部分,并接受社区监督。作者强调该项目结构简单、易于二次开发,用户可改造为自己的风格,希望推动“人人都做导演”的社区共创生态。此前上美影风格skill已发布孟母三迁等多个制作案例供社区检验效果。
核心观点:风格prompt正被封装为开源skill资产,AI视频创作的竞争正从拼模型算力转向拼审美与风格沉淀。
原文链接:Linux.do
开源社区近日对新一代文生音乐模型YuE2展开讨论,有用户分享实测体验称,该模型生成的歌曲质量已可与闭源商业产品Suno一较高下。据发帖者介绍,其先用GPT生成了一段《鬼灭之刃》主题歌词,再交由YuE2谱曲演唱,最终产出的歌曲完成度很高,并附上了试听音频供社区参考。从技术参数看,YuE2的突出特点是模型体积小、推理速度快。发帖者表示,模型可在一块12GB显存的游戏级显卡上完成本地推理,无需数据中心级硬件,这大幅降低了个人用户和开发者本地部署的门槛。相比之下,主流商用文生音乐服务多依赖云端算力,用户需以订阅制付费使用,生成过程可控性有限。YuE是此前开源的文生音乐模型系列,支持从歌词直接生成带人声的完整歌曲,涵盖作曲、编曲、演唱等环节,YuE2作为迭代版本在生成质量与效率上进一步优化,目前该话题已吸引多位社区用户参与讨论。文生音乐是AIGC领域的重要分支,此前主要由Suno、Udio等闭源产品主导,开源模型的快速追赶意味着本地化、可定制的音乐生成方案正逐步走向实用,对独立音乐创作、游戏配乐、短视频制作等场景具有潜在应用价值。
核心观点:开源文生音乐追平闭源标杆,预示AIGC正从云端订阅模式转向本地化、可定制的创作者自主生态。
原文链接:Linux.do
据Linux.do社区用户反馈,OpenAI上线了网页版Codex服务,访问地址为prism.openai.com。该服务允许开发者直接在浏览器中使用Codex进行编程开发,并支持直接上传文件夹开展项目,无需在本地配置环境。值得注意的是,社区用户实测发现,网页版Codex的使用不会占用原有Codex的额度,这意味着Plus和Pro订阅用户可以在现有配额之外获得额外的使用空间。根据发帖用户的信息,其Plus和Pro账号均可正常使用该功能,但免费账号能否使用尚不确定,有待进一步验证。相比此前的命令行工具形态,网页版Codex进一步降低了使用门槛,用户无需安装本地客户端或配置终端环境,打开网页即可启动编程任务,文件夹上传功能也让项目级开发在云端成为可能。该消息目前主要来自社区用户分享,OpenAI官方尚未发布正式公告,产品的正式名称、额度政策是否会调整、免费用户开放时间等细节仍有待观察。对于日常需要在不同设备间切换的开发者而言,云端化的编程助手提供了新的工作流选择。
核心观点:网页版Codex免额度开放,标志着AI编程竞争已从模型能力转向云端入口与配额策略的贴身较量。
原文链接:Linux.do
Codex是OpenAI推出的AI编程智能体,其内置的request_user_input工具允许模型在执行任务过程中向用户提出带选项的问题,以澄清模糊需求。但该功能默认仅在计划模式(Plan Mode)下可用,普通模式下无法使用。Linux.do论坛用户分享了一个配置技巧,可在非计划模式下解锁这一交互能力。具体操作分两步:第一步,在Codex的配置文件config.toml的[features]区块中添加default_mode_request_user_input = true一行,开启普通模式下的用户输入请求功能;第二步,需在AGENT.md项目说明文件中明确提示Codex使用request_user_input工具。作者特别强调,若缺少第二步,即使功能已在配置中开启,Codex在实际运行中也基本不会主动调用该工具。这一技巧的核心价值在于让开发者在日常编码流程中也能获得交互式确认能力,当Agent面对模糊需求或多路径选择时,可主动向用户提问并给出选项,而非自行猜测后继续执行,有助于减少返工、提升任务完成的准确度。整个配置过程仅需修改配置文件与项目说明文档,成本低,适合Codex用户尝试。
核心观点:会提问的Agent比只会执行的Agent更值钱,人机交互节点的设计正成为AI编程工具竞争的新分水岭。
原文链接:Linux.do
开发者近日在 V2EX 分享其开源自动追番工具 Kaloscope 的更新内容。该工具定位为本地媒体库管理软件,面向追番追剧与弹幕观看需求,通过可视化工作流接入数据源,支持影视、漫画、小说的搜索预览、自动下载、入库刮削及 Web 端直接播放。本次本体更新聚焦下载体验优化:新增对 NAS 迅雷和 OpenList 两类下载器的支持,其中 OpenList 可对接网盘离线下载,任务完成后自动将文件拉回本地。下载器配置引入预设模式,用户填写必要参数即可完成接入,同时保留 YAML 编辑能力。弹幕方面,媒体库页面现支持为整部番剧批量匹配各集弹幕,Web 端弹幕新增重复合并与正则过滤功能。此外,项目推出原生 Android TV 客户端,开发者表示该客户端完全采用 Vibe Coding 方式开发,是其首次全程依靠 AI 完成项目,经一个多月的反复修改后达到基本可用状态。客户端要求 Android 6.0 及以上设备,配合可访问的 Kaloscope 服务端使用,支持多服务器保存与切换。功能覆盖首页信息流、自动匹配弹幕的视频播放、遥控器操作的漫画小说阅读、网络搜索与个性化设置,播放、弹幕、字幕及阅读偏好均可独立调整。项目代码托管于 GitHub,包含本体与 TV 客户端两个仓库,开发者欢迎用户试用反馈并提交 Issue。
核心观点:AI 编程已能支撑个人开发者独立交付多端完整应用,但从可用到好用的细节鸿沟,仍需大量人工迭代填补。
原文链接:V2EX 分享发现
DataZen 发布 v0.2.1 版本,重点强化 SQL 编辑体验。新版本引入首次运行引导向导,通过连接示例数据库、探索 AI 辅助等 3 步帮助用户快速上手,内置 SQLite 示例库并支持 8 种语言,引导进度可恢复。SQL 编辑器新增 4 种执行策略:Run Current 基于 AST 自动识别光标所在单条语句并仅执行该句;Run Selection 仅执行高亮选中的代码块;Run All 执行完整批处理;Ask 则在每次执行前弹出策略确认窗口。编辑器还加入意图操作灯泡菜单,可将 SELECT 中的星号一键展开为完整列清单、为裸列名补充表限定符或反向收回,三种意图可循环切换,并保留 Alt-Enter 快捷键。Paste as IN 功能支持将表格或日志中复制的多行 ID 一键格式化为 IN 查询所需格式。安全方面,新版本增加高危执行拦截机制:无 WHERE 条件的 UPDATE/DELETE 语句触发红色警告并要求二次确认,占位符未填值时直接拦截,防止隐式 NULL 导致全表更新。AI 能力上同时支持 OpenAI、Anthropic、DeepSeek、Ollama 及自定义端点,本地模型放宽上下文限制,公网模型自动脱敏,SQL 错误可一键带入 AI 诊断。此外,查询结果可转为折线图、柱状图等并导出 PNG/SVG,内置 Dashboard 支持拖拽布局,还新增原生 Redis 驱动,支持 Key 树浏览、实时 Monitor 与 Pub/Sub。
核心观点:数据库客户端的竞争焦点正从连接与编辑转向 AI 辅助,而隐私脱敏与高危拦截正成为企业级采纳的关键门槛。
原文链接:V2EX 分享发现