- android - 多次调用 OnPrimaryClipChangedListener
- android - 无法更新 RecyclerView 中的 TextView 字段
- android.database.CursorIndexOutOfBoundsException : Index 0 requested, 光标大小为 0
- android - 使用 AppCompat 时,我们是否需要明确指定其 UI 组件(Spinner、EditText)颜色
我正在尝试使用 NodeWebkit 创建一个应用程序。我正在使用 node-phantom-simple 模块抓取内容。使用该模块,我能够从网站上抓取内容。但我应该如何在 html 端访问它。我认为我无法为这种情况创建休息服务。这是代码示例:
var file = require('file.js');
var gui = require('nw.gui');
var menu = new gui.Menu({ type: 'menubar' });
var express = require('express');
var fs = require('fs');
var request = require('request');
var cheerio = require('cheerio');
var app = express();
var driver = require('node-phantom-simple');
url = 'http://www.espncricinfo.com/';
request(url, function(error, response, html){
if(!error){
var $ = cheerio.load(html);
var title, release, rating;
var json = { title : "", release : "", rating : ""};
$('.scoreline-list').first().filter(function(){
var data = $(this);
var numOfMatches = data.children().length;
console.log("Number of Matches: ",numOfMatches);
var matches=[];
//GET URL FOR EACH MATCH
for(x=0;x<numOfMatches;x++)
{
var lielem = data.children().eq(x);
matches[x] = "http://www.espncricinfo.com" + lielem.children().first().attr('href');
$('#editor').val(matches[x]);
console.log(matches[x]);
}
//FOR EACH MATCH URL
for(x=0;x<numOfMatches;x++)
{
var matchurl = matches[x];
//console.log(matchurl);
driver.create({ path: require('phantomjs').path }, function (err, browser) {
return browser.createPage(function (err, page) {
return page.open(matchurl, function (err,status) {
console.log("opened site? ", status);
page.includeJs('http://ajax.googleapis.com/ajax/libs/jquery/1.7.2/jquery.min.js', function (err) {
// jQuery Loaded.
// Wait for a bit for AJAX content to load on the page. Here, we are waiting 5 seconds.
setTimeout(function () {
return page.evaluate(function () {
//Get what you want from the page using jQuery. A good way is to populate an object with all the jQuery commands that you need and then return the object.
var h2Arr = [];
$('.innings-information').each(function () { h2Arr.push($(this).html()); });
return {
h2: h2Arr
};
}, function (err,result) {
console.log(result);
browser.exit();
});
}, 5000);
});
});
});
});
setTimeout(function(){
//waiting for the jquery to load
}, 5000);
} //END FOR LOOP EACH MATCH URL
})
}
})
感谢您的帮助!
最佳答案
为什么你不能为此创建一个休息端点?只需缓存每个抓取操作的结果,然后在 http 端点上返回缓存。
var cache={};
app.get('/myendpoint', function(req, res) {
res.json(cache);
})
request(url, function(error, response, html){
...
setTimeout(function () {
...
console.log(result);
//set cache here
cache=result;
browser.exit();
});
}, 5000);
});
app.listen(1338);
如果要缓存更新,请将抓取函数包装在 setInterval 中。
var cache={};
app.get('/myendpoint', function(req, res) {
res.json(cache);
})
function updateCache() {
request(url, function(error, response, html){
...
setTimeout(function () {
...
console.log(result);
//set cache here
cache=result;
browser.exit();
});
}, 5000);
});
}
//Update cache every 60 secs.
setInterval(updateCache, 60000);
app.listen(1338);
关于javascript - 如何在 NodeWebkit 的 html 代码中访问从 Node 模块抓取的数据,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/34563370/
我最近在我的机器上安装了 cx_Oracle 模块,以便连接到远程 Oracle 数据库服务器。 (我身边没有 Oracle 客户端)。 Python:版本 2.7 x86 Oracle:版本 11.
我想从 python timeit 模块检查打印以下内容需要多少时间,如何打印, import timeit x = [x for x in range(10000)] timeit.timeit("
我盯着 vs 代码编辑器上的 java 脚本编码,当我尝试将外部模块包含到我的项目中时,代码编辑器提出了这样的建议 -->(文件是 CommonJS 模块;它可能会转换为 ES6 模块。 )..有什么
我有一个 Node 应用程序,我想在标准 ES6 模块格式中使用(即 "type": "module" in the package.json ,并始终使用 import 和 export)而不转译为
我正在学习将 BlueprintJS 合并到我的 React 网络应用程序中,并且在加载某些 CSS 模块时遇到了很多麻烦。 我已经安装了 npm install @blueprintjs/core和
我需要重构一堆具有这样的调用的文件 define(['module1','module2','module3' etc...], function(a, b, c etc...) { //bun
我是 Angular 的新手,正在学习各种教程(Codecademy、thinkster.io 等),并且已经看到了声明应用程序容器的两种方法。首先: var app = angular.module
我正在尝试将 OUnit 与 OCaml 一起使用。 单元代码源码(unit.ml)如下: open OUnit let empty_list = [] let list_a = [1;2;3] le
我在 Angular 1.x 应用程序中使用 webpack 和 ES6 模块。在我设置的 webpack.config 中: resolve: { alias: { 'angular':
internal/modules/cjs/loader.js:750 return process.dlopen(module, path.toNamespacedPath(filename));
在本教程中,您将借助示例了解 JavaScript 中的模块。 随着我们的程序变得越来越大,它可能包含许多行代码。您可以使用模块根据功能将代码分隔在单独的文件中,而不是将所有内容都放在一个文件
我想知道是否可以将此代码更改为仅调用 MyModule.RED 而不是 MyModule.COLORS.RED。我尝试将 mod 设置为变量来存储颜色,但似乎不起作用。难道是我方法不对? (funct
我有以下代码。它是一个 JavaScript 模块。 (function() { // Object var Cahootsy; Cahootsy = { hello:
关闭。这个问题是 opinion-based 。它目前不接受答案。 想要改进这个问题?更新问题,以便 editing this post 可以用事实和引文来回答它。 关闭 2 年前。 Improve
从用户的角度来看,一个模块能够通过 require 加载并返回一个 table,模块导出的接口都被定义在此 table 中(此 table 被作为一个 namespace)。所有的标准库都是模块。标
Ruby的模块非常类似类,除了: 模块不可以有实体 模块不可以有子类 模块由module...end定义. 实际上...模块的'模块类'是'类的类'这个类的父类.搞懂了吗?不懂?让我们继续看
我有一个脚本,它从 CLI 获取 3 个输入变量并将其分别插入到 3 个变量: GetOptions("old_path=s" => \$old_path, "var=s" =
我有一个简单的 python 包,其目录结构如下: wibble | |-----foo | |----ping.py | |-----bar | |----pong.py 简单的
这种语法会非常有用——这不起作用有什么原因吗?谢谢! module Foo = { let bar: string = "bar" }; let bar = Foo.bar; /* works *
我想运行一个命令: - name: install pip shell: "python {"changed": true, "cmd": "python <(curl https://boot
我是一名优秀的程序员,十分优秀!